Utiliser MiniMax H3 : poids ouverts et API

10 min de lecture

how-to-use-minimax-h3

MiniMax H3 peut être utilisé via les poids ouverts de H3-Base ou l’API hébergée de MiniMax. Choisissez les poids ouverts si vous avez besoin d’une inférence auto-hébergée et d’un contrôle au niveau du modèle. Choisissez l’API si vous souhaitez générer du contenu dans une application ou un workflow automatisé sans exploiter de serveurs de modèles.

Le meilleur mode d’accès dépend des tâches que vous souhaitez prendre en charge. Ce guide explique comment démarrer avec chaque option, puis les comparer au moyen d’un test reproductible.

Poids ouverts ou API : quel mode d’accès à H3 choisir ?

OptionIdéal pourVous gérezPrincipale limite
Poids ouverts de H3-BaseÉquipes ML, chercheurs, pipelines personnalisés et déploiements auto-hébergésFichiers de modèle, calcul, dépendances, inférence, stockage, sécurité et mises à jourLes poids publics couvrent H3-Base en 768p, et non le système H3 hébergé complet
API MiniMax H3Applications, tâches par lots, prototypes et flux de travail de contenu automatisésIdentifiants API, requêtes, état des tâches, nouvelles tentatives, stockage, budgets et logique produitVous utilisez le service hébergé de MiniMax plutôt que de contrôler le serveur de modèles

Utilisez les poids ouverts si les fichiers de modèle doivent s'exécuter dans l'infrastructure que vous contrôlez. Cet itinéraire convient également à la recherche, au code d'inférence personnalisé ou aux expériences de pipeline local.

Utilisez l’API MiniMax si vous souhaitez lancer une fonctionnalité, automatiser des lots ou tester H3 sans maintenir d’infrastructure GPU. Vous devrez tout de même créer le workflow autour de chaque tâche de génération.

Si les deux modes d’accès conviennent, commencez par l’API. Elle offre généralement à une équipe de développement le chemin le plus court vers une requête H3 fonctionnelle. Passez aux poids ouverts uniquement lorsque l’auto-hébergement répond à un besoin précis.

Comment exécuter H3-Base avec des poids ouverts

MiniMax a publié deux familles de checkpoints H3-Base. FL2VA gère la génération de texte et le guidage de la première image, de la dernière image ou de la première et de la dernière image. Ref2VA utilise des images de référence, de la vidéo et de l'audio en option pour guider le résultat.

La publication ne couvre que l’étape Base du système H3 complet. H3-Base génère une sortie audiovisuelle en 768p. Les composants Context-IR et Regenerate-2K hébergés par MiniMax ne sont pas inclus dans le paquet actuel de poids ouverts.

Choisissez le checkpoint avant de télécharger des fichiers

Choisissez le checkpoint en fonction du type d’entrée que vous comptez réellement utiliser :

Votre entréeCheckpointTravail typique
Texte uniquementH3-Base FL2VAGénérer une scène à partir d'une description écrite
Une image d'ouvertureH3-Base FL2VAAnimer à partir d'une première image fixe
Une image de finH3-Base FL2VAGénérer vers une image finale fixe
Images d’ouverture et de finH3-Base FL2VAConstruire une transition entre deux images de référence
Images, vidéos et références audio facultativesH3-Base Ref2VAGuider l’identité, le style, le mouvement, la caméra, la voix ou le son

Ne téléchargez pas Ref2VA simplement parce qu’il semble plus avancé. FL2VA convient directement aux tâches texte et aux images initiale ou finale fixes. Ref2VA répond à un autre workflow d’entrée.

Créez un flux de travail local avant d'ajouter des composants personnalisés

  1. Lisez la licence et la carte de modèle. Confirmez que votre utilisation, votre emplacement, votre plan de distribution et votre organisation correspondent aux conditions publiées.
  2. Choisissez un chemin d'inférence pris en charge. MiniMax répertorie SGLang, vLLM, Diffusers et ComfyUI dans le dépôt officiel H3.
  3. Téléchargez le checkpoint correspondant et les composants requis. Gardez les fichiers FL2VA et Ref2VA clairement séparés.
  4. Suivez la configuration officielle de l’environnement choisi. Épinglez les versions logicielles qui produisent votre premier résultat correct.
  5. Exécutez un travail simple. Enregistrez le prompt, les entrées, le flux de travail, la graine si disponible et la sortie.
  6. Enregistrez l’utilisation des ressources. Notez le temps de démarrage, la VRAM maximale, le temps de génération, le stockage et les pannes sur votre propre matériel.

Évitez de commencer simultanément avec des nœuds communautaires, des adaptateurs, des modifications de quantification et un ensemble complexe de références. Si le premier essai échoue, un trop grand nombre de variables complique l’identification de la cause.

Ce que le contrôle local vous donne et ne vous donne pas

L'auto-hébergement vous permet de contrôler l'environnement de service, le code environnant, la gestion des fichiers et les paramètres d'inférence compatibles. Il vous permet également de créer votre propre pipeline de prétraitement et de révision.

Ce contrôle ne transforme pas H3-Base en un système hébergé complet. Un préprocesseur personnalisé n'est pas l'implémentation Context-IR de MiniMax. Un upscaler distinct n’est pas l’étape officielle de Regenerate-2K.

Le déploiement local vous transfère aussi des coûts et des responsabilités. Calcul, stockage, temps d’ingénierie, surveillance, mesures de protection et exécutions échouées restent à votre charge. La confidentialité dépend de vos journaux, règles d’accès, stockage des ressources et composants tiers.

Comment utiliser MiniMax H3 via l'API

La voie API évite l’hébergement du modèle, mais pas le travail côté application. La génération H3 fonctionne comme une tâche asynchrone : créez la tâche, conservez son ID, vérifiez son état et récupérez le résultat final.

Commencez par le cycle de vie minimum de l'API

  1. Créez un compte de plateforme MiniMax et une clé API. Stockez la clé en dehors du code côté client et des référentiels publics.
  2. Choisissez un mode d’entrée. Commencez par du texte ou une requête basée sur une image avant d’ajouter plusieurs références.
  3. Créez une tâche de génération vidéo. Utilisez le modèle MiniMax-H3 et incluez un prompt non vide.
  4. Enregistrez l'ID de tâche renvoyé. Associez-le à votre utilisateur, à vos fichiers d'entrée et aux paramètres de demande.
  5. Interrogez le point de terminaison de l’état de la tâche. Gérez séparément les états en cours, réussis et échoués.
  6. Récupérez et stockez le résultat. Téléchargez la sortie vers le stockage que vous contrôlez au lieu de traiter l'emplacement renvoyé comme permanent.

Le guide officiel de génération vidéo de MiniMax contient les champs de requête et les détails des endpoints en vigueur. Utilisez le schema actuel au lieu de copier un ancien payload depuis un tutoriel tiers.

Ajoutez des mesures de protection une fois la première requête fonctionnelle

Une fois qu'une demande est terminée de bout en bout, ajoutez les contrôles environnants :

  • Validez les prompts et les médias avant de soumettre une tâche payante.
  • Empêchez les soumissions en double lorsqu'un utilisateur actualise ou réessaye.
  • Définissez un intervalle d’interrogation et une politique d’attente maximale.
  • Séparez les erreurs de demande des échecs de génération.
  • Stockez les ID de tâches afin que les sessions interrompues puissent récupérer leurs tâches.
  • Suivez les tentatives infructueuses et le coût final par résultat utilisable.
  • Appliquez vos propres règles d'accès, de modération, de conservation et de suppression.

N’augmentez pas la concurrence avant de pouvoir récupérer proprement une tâche ayant échoué. Un appel API réussi n’est que le début d’un workflow utilisateur fiable.

Comparez les deux modes d’accès avec un petit test H3

Une comparaison équitable exige les mêmes ressources sources, le même prompt, la même cible et les mêmes critères d’acceptation. Gardez le premier test court et visuellement simple.

Carte de test réutilisable

Image source : une image 16:9 sous licence représentant une tasse en céramique blanche mate sur une table en bois. L’anse et l’étiquette imprimée doivent être nettement visibles.

Prompt :

Conservez la tasse, l’anse, l’étiquette, la table et l’arrière-plan de l’image d’entrée. La vapeur s’élève lentement tandis que la caméra effectue un léger mouvement avant. L’étiquette reste lisible. L’audio contient une ambiance intérieure calme et un léger tintement de céramique. Aucune musique.

Critères d'acceptation :

  • La forme de la tasse et l’anse restent stables.
  • L'étiquette imprimée reste lisible.
  • La vapeur se déplace sans modifier le design de la tasse.
  • Le plan utilise une poussée lente plutôt que plusieurs mouvements de caméra.
  • Le clip comprend une ambiance intérieure et un tintement de céramique.
  • Aucune musique n'apparaît.

Utilisez la durée partagée et le rapport hauteur/largeur les plus proches disponibles dans les deux itinéraires. Si un itinéraire ne peut pas correspondre à un paramètre, enregistrez la différence au lieu de modifier l'objectif créatif.

Enregistrez le résultat, pas seulement le temps de rendu

MesurerQuoi écrire
Temps d'installationTemps entre un projet vide et le premier travail accepté
Temps de générationTemps écoulé entre le travail accepté et la sortie terminée
ÉchecsErreurs de soumission, erreurs d'exécution, tâches ayant échoué et fichiers inutilisables
Nouvelles tentativesNombre de générations supplémentaires nécessaires
CoûtCoût de calcul ou d'API réel pour toutes les tentatives
Résultat visuelLa tasse, l’anse, l’étiquette, la vapeur et le mouvement de caméra respectent-ils les critères ?
Résultat audioL’ambiance intérieure, le tintement et l’instruction « sans musique » sont-ils respectés ?
Travaux de suiviLe découpage, la réparation, le stockage, la mise à l'échelle ou l'édition sont toujours nécessaires

Pour une exécution locale, consignez également le matériel, l’environnement d’exécution, les versions logicielles, la précision ou la quantification, le pic de VRAM et la source du checkpoint. Pour une exécution via l’API, consignez les états des tâches, les erreurs de réponse et le comportement du stockage.

Un seul résultat ne peut pas prouver qu’un itinéraire est toujours plus rapide ou meilleur. Il peut révéler quel itinéraire correspond à votre équipe actuelle, à votre infrastructure et à votre tolérance aux tentatives infructueuses.

Résoudre les problèmes de configuration les plus courants

Le workflow local ne se chargera pas

Vérifiez que le checkpoint correspond au flux de travail. Comparez ensuite les noms de fichiers, les emplacements et les versions de dépendances avec le référentiel officiel. Supprimez les nœuds tiers et les optimisations jusqu'à l'exécution du workflow de base.

L'API accepte la demande, mais votre application perd le résultat

Conservez l'ID de tâche dès que MiniMax le renvoie. Votre interface doit reprendre les vérifications d'état après une actualisation ou un échec de connexion temporaire. Copiez les médias terminés dans votre propre stockage.

La sortie ignore une partie du prompt

Réduisez le test à un sujet, une action, un mouvement de caméra et un objectif audio. Ajoutez de la complexité seulement après que cette version plus petite ait fonctionné. Pour une génération basée sur des références, attribuez à chaque source une tâche claire au lieu de demander à chaque source de tout contrôler.

Les résultats locaux et API ne correspondent pas

Comparez d’abord les entrées réelles, le checkpoint ou l’étiquette du modèle, la durée, la résolution, le prompt et tous les paramètres d’inférence. La version ouverte H3-Base et le service hébergé ne sont pas des chemins système identiques, il ne faut donc pas supposer une parité de sortie exacte.

Quelle route H3 convient à votre travail ?

Votre profilCommencez parPourquoi
Un créateur indépendant sans infrastructure MLAPI MiniMaxVous pouvez générer sans utiliser de serveur de modèles
Un développeur créant une fonctionnalité H3API MiniMaxLe cycle de vie des tâches s'adapte aux produits, aux files d'attente et aux tâches automatisées
Un ingénieur ou un chercheur MLPoids ouvertsVous pouvez examiner et utiliser directement les checkpoints H3-Base publiés
Un studio avec des exigences strictes en matière d'auto-hébergementPoids ouvertsVous contrôlez le déploiement et les flux de données environnants
Une équipe ne sait pas de quel itinéraire elle a besoinAPI MiniMax, puis un test localL'API établit une base de référence avant d'investir dans l'infrastructure

Conservez des ressources sources, des prompts et des critères d’acceptation réutilisables. Vous pourrez ainsi comparer plus facilement les modes d’accès sans reconstruire le brief créatif à chaque fois.

Foire aux questions

Puis-je utiliser MiniMax H3 sans posséder de GPU ?

Oui. Utilisez l’API hébergée de MiniMax si vous ne souhaitez pas exploiter une infrastructure GPU. Vous aurez tout de même besoin d’une application ou d’un script qui crée les tâches, vérifie leur état et enregistre les résultats.

Les poids ouverts H3 sont-ils identiques au service H3 hébergé ?

Non. Les poids publics couvrent H3-Base FL2VA et Ref2VA. Le système complet utilise aussi les composants hébergés Context-IR et Regenerate-2K, absents du paquet actuel de poids ouverts.

H3-Base local peut-il générer le résultat officiel complet en 2K ?

Non. La chaîne H3-Base locale documentée produit du 768p. La chaîne officielle vers le 2K de MiniMax utilise Regenerate-2K, qui ne figure pas dans la publication publique actuelle.

Dois-je choisir FL2VA ou Ref2VA ?

Choisissez FL2VA pour générer à partir de texte ou fixer les images initiale et finale. Choisissez Ref2VA lorsque des images, une vidéo ou un fichier audio facultatif doivent guider l’identité, le style, le mouvement, la caméra, la voix ou le son.

Puis-je utiliser H3 pour des projets commerciaux ?

Peut-être, mais les conditions dépendent de votre mode d’accès et de votre situation. Consultez la licence communautaire pour les poids ouverts et les conditions actuelles de la plateforme pour l’usage hébergé. Vérifiez les restrictions territoriales, de revenus, d’attribution, de distribution et d’usage avant la publication.

Choisissez votre mode d’accès à MiniMax H3

Commencez par l’API lorsque vous devez obtenir rapidement un résultat fonctionnel. Choisissez les poids ouverts lorsque l’auto-hébergement ou l’accès au niveau du modèle répond à un besoin clairement identifié.

MiniMax H3 est désormais disponible dans DomoAI via Omni Reference.

Articles récents