MiniMax H3 peut être utilisé via les poids ouverts de H3-Base ou l’API hébergée de MiniMax. Choisissez les poids ouverts si vous avez besoin d’une inférence auto-hébergée et d’un contrôle au niveau du modèle. Choisissez l’API si vous souhaitez générer du contenu dans une application ou un workflow automatisé sans exploiter de serveurs de modèles.
Le meilleur mode d’accès dépend des tâches que vous souhaitez prendre en charge. Ce guide explique comment démarrer avec chaque option, puis les comparer au moyen d’un test reproductible.
Poids ouverts ou API : quel mode d’accès à H3 choisir ?
| Option | Idéal pour | Vous gérez | Principale limite |
|---|---|---|---|
| Poids ouverts de H3-Base | Équipes ML, chercheurs, pipelines personnalisés et déploiements auto-hébergés | Fichiers de modèle, calcul, dépendances, inférence, stockage, sécurité et mises à jour | Les poids publics couvrent H3-Base en 768p, et non le système H3 hébergé complet |
| API MiniMax H3 | Applications, tâches par lots, prototypes et flux de travail de contenu automatisés | Identifiants API, requêtes, état des tâches, nouvelles tentatives, stockage, budgets et logique produit | Vous utilisez le service hébergé de MiniMax plutôt que de contrôler le serveur de modèles |
Utilisez les poids ouverts si les fichiers de modèle doivent s'exécuter dans l'infrastructure que vous contrôlez. Cet itinéraire convient également à la recherche, au code d'inférence personnalisé ou aux expériences de pipeline local.
Utilisez l’API MiniMax si vous souhaitez lancer une fonctionnalité, automatiser des lots ou tester H3 sans maintenir d’infrastructure GPU. Vous devrez tout de même créer le workflow autour de chaque tâche de génération.
Si les deux modes d’accès conviennent, commencez par l’API. Elle offre généralement à une équipe de développement le chemin le plus court vers une requête H3 fonctionnelle. Passez aux poids ouverts uniquement lorsque l’auto-hébergement répond à un besoin précis.
Comment exécuter H3-Base avec des poids ouverts
MiniMax a publié deux familles de checkpoints H3-Base. FL2VA gère la génération de texte et le guidage de la première image, de la dernière image ou de la première et de la dernière image. Ref2VA utilise des images de référence, de la vidéo et de l'audio en option pour guider le résultat.
La publication ne couvre que l’étape Base du système H3 complet. H3-Base génère une sortie audiovisuelle en 768p. Les composants Context-IR et Regenerate-2K hébergés par MiniMax ne sont pas inclus dans le paquet actuel de poids ouverts.
Choisissez le checkpoint avant de télécharger des fichiers
Choisissez le checkpoint en fonction du type d’entrée que vous comptez réellement utiliser :
| Votre entrée | Checkpoint | Travail typique |
|---|---|---|
| Texte uniquement | H3-Base FL2VA | Générer une scène à partir d'une description écrite |
| Une image d'ouverture | H3-Base FL2VA | Animer à partir d'une première image fixe |
| Une image de fin | H3-Base FL2VA | Générer vers une image finale fixe |
| Images d’ouverture et de fin | H3-Base FL2VA | Construire une transition entre deux images de référence |
| Images, vidéos et références audio facultatives | H3-Base Ref2VA | Guider l’identité, le style, le mouvement, la caméra, la voix ou le son |
Ne téléchargez pas Ref2VA simplement parce qu’il semble plus avancé. FL2VA convient directement aux tâches texte et aux images initiale ou finale fixes. Ref2VA répond à un autre workflow d’entrée.
Créez un flux de travail local avant d'ajouter des composants personnalisés
- Lisez la licence et la carte de modèle. Confirmez que votre utilisation, votre emplacement, votre plan de distribution et votre organisation correspondent aux conditions publiées.
- Choisissez un chemin d'inférence pris en charge. MiniMax répertorie SGLang, vLLM, Diffusers et ComfyUI dans le dépôt officiel H3.
- Téléchargez le checkpoint correspondant et les composants requis. Gardez les fichiers FL2VA et Ref2VA clairement séparés.
- Suivez la configuration officielle de l’environnement choisi. Épinglez les versions logicielles qui produisent votre premier résultat correct.
- Exécutez un travail simple. Enregistrez le prompt, les entrées, le flux de travail, la graine si disponible et la sortie.
- Enregistrez l’utilisation des ressources. Notez le temps de démarrage, la VRAM maximale, le temps de génération, le stockage et les pannes sur votre propre matériel.
Évitez de commencer simultanément avec des nœuds communautaires, des adaptateurs, des modifications de quantification et un ensemble complexe de références. Si le premier essai échoue, un trop grand nombre de variables complique l’identification de la cause.
Ce que le contrôle local vous donne et ne vous donne pas
L'auto-hébergement vous permet de contrôler l'environnement de service, le code environnant, la gestion des fichiers et les paramètres d'inférence compatibles. Il vous permet également de créer votre propre pipeline de prétraitement et de révision.
Ce contrôle ne transforme pas H3-Base en un système hébergé complet. Un préprocesseur personnalisé n'est pas l'implémentation Context-IR de MiniMax. Un upscaler distinct n’est pas l’étape officielle de Regenerate-2K.
Le déploiement local vous transfère aussi des coûts et des responsabilités. Calcul, stockage, temps d’ingénierie, surveillance, mesures de protection et exécutions échouées restent à votre charge. La confidentialité dépend de vos journaux, règles d’accès, stockage des ressources et composants tiers.
Comment utiliser MiniMax H3 via l'API
La voie API évite l’hébergement du modèle, mais pas le travail côté application. La génération H3 fonctionne comme une tâche asynchrone : créez la tâche, conservez son ID, vérifiez son état et récupérez le résultat final.
Commencez par le cycle de vie minimum de l'API
- Créez un compte de plateforme MiniMax et une clé API. Stockez la clé en dehors du code côté client et des référentiels publics.
- Choisissez un mode d’entrée. Commencez par du texte ou une requête basée sur une image avant d’ajouter plusieurs références.
- Créez une tâche de génération vidéo. Utilisez le modèle
MiniMax-H3et incluez un prompt non vide. - Enregistrez l'ID de tâche renvoyé. Associez-le à votre utilisateur, à vos fichiers d'entrée et aux paramètres de demande.
- Interrogez le point de terminaison de l’état de la tâche. Gérez séparément les états en cours, réussis et échoués.
- Récupérez et stockez le résultat. Téléchargez la sortie vers le stockage que vous contrôlez au lieu de traiter l'emplacement renvoyé comme permanent.
Le guide officiel de génération vidéo de MiniMax contient les champs de requête et les détails des endpoints en vigueur. Utilisez le schema actuel au lieu de copier un ancien payload depuis un tutoriel tiers.
Ajoutez des mesures de protection une fois la première requête fonctionnelle
Une fois qu'une demande est terminée de bout en bout, ajoutez les contrôles environnants :
- Validez les prompts et les médias avant de soumettre une tâche payante.
- Empêchez les soumissions en double lorsqu'un utilisateur actualise ou réessaye.
- Définissez un intervalle d’interrogation et une politique d’attente maximale.
- Séparez les erreurs de demande des échecs de génération.
- Stockez les ID de tâches afin que les sessions interrompues puissent récupérer leurs tâches.
- Suivez les tentatives infructueuses et le coût final par résultat utilisable.
- Appliquez vos propres règles d'accès, de modération, de conservation et de suppression.
N’augmentez pas la concurrence avant de pouvoir récupérer proprement une tâche ayant échoué. Un appel API réussi n’est que le début d’un workflow utilisateur fiable.
Comparez les deux modes d’accès avec un petit test H3
Une comparaison équitable exige les mêmes ressources sources, le même prompt, la même cible et les mêmes critères d’acceptation. Gardez le premier test court et visuellement simple.
Carte de test réutilisable
Image source : une image 16:9 sous licence représentant une tasse en céramique blanche mate sur une table en bois. L’anse et l’étiquette imprimée doivent être nettement visibles.
Prompt :
Conservez la tasse, l’anse, l’étiquette, la table et l’arrière-plan de l’image d’entrée. La vapeur s’élève lentement tandis que la caméra effectue un léger mouvement avant. L’étiquette reste lisible. L’audio contient une ambiance intérieure calme et un léger tintement de céramique. Aucune musique.
Critères d'acceptation :
- La forme de la tasse et l’anse restent stables.
- L'étiquette imprimée reste lisible.
- La vapeur se déplace sans modifier le design de la tasse.
- Le plan utilise une poussée lente plutôt que plusieurs mouvements de caméra.
- Le clip comprend une ambiance intérieure et un tintement de céramique.
- Aucune musique n'apparaît.
Utilisez la durée partagée et le rapport hauteur/largeur les plus proches disponibles dans les deux itinéraires. Si un itinéraire ne peut pas correspondre à un paramètre, enregistrez la différence au lieu de modifier l'objectif créatif.
Enregistrez le résultat, pas seulement le temps de rendu
| Mesurer | Quoi écrire |
|---|---|
| Temps d'installation | Temps entre un projet vide et le premier travail accepté |
| Temps de génération | Temps écoulé entre le travail accepté et la sortie terminée |
| Échecs | Erreurs de soumission, erreurs d'exécution, tâches ayant échoué et fichiers inutilisables |
| Nouvelles tentatives | Nombre de générations supplémentaires nécessaires |
| Coût | Coût de calcul ou d'API réel pour toutes les tentatives |
| Résultat visuel | La tasse, l’anse, l’étiquette, la vapeur et le mouvement de caméra respectent-ils les critères ? |
| Résultat audio | L’ambiance intérieure, le tintement et l’instruction « sans musique » sont-ils respectés ? |
| Travaux de suivi | Le découpage, la réparation, le stockage, la mise à l'échelle ou l'édition sont toujours nécessaires |
Pour une exécution locale, consignez également le matériel, l’environnement d’exécution, les versions logicielles, la précision ou la quantification, le pic de VRAM et la source du checkpoint. Pour une exécution via l’API, consignez les états des tâches, les erreurs de réponse et le comportement du stockage.
Un seul résultat ne peut pas prouver qu’un itinéraire est toujours plus rapide ou meilleur. Il peut révéler quel itinéraire correspond à votre équipe actuelle, à votre infrastructure et à votre tolérance aux tentatives infructueuses.
Résoudre les problèmes de configuration les plus courants
Le workflow local ne se chargera pas
Vérifiez que le checkpoint correspond au flux de travail. Comparez ensuite les noms de fichiers, les emplacements et les versions de dépendances avec le référentiel officiel. Supprimez les nœuds tiers et les optimisations jusqu'à l'exécution du workflow de base.
L'API accepte la demande, mais votre application perd le résultat
Conservez l'ID de tâche dès que MiniMax le renvoie. Votre interface doit reprendre les vérifications d'état après une actualisation ou un échec de connexion temporaire. Copiez les médias terminés dans votre propre stockage.
La sortie ignore une partie du prompt
Réduisez le test à un sujet, une action, un mouvement de caméra et un objectif audio. Ajoutez de la complexité seulement après que cette version plus petite ait fonctionné. Pour une génération basée sur des références, attribuez à chaque source une tâche claire au lieu de demander à chaque source de tout contrôler.
Les résultats locaux et API ne correspondent pas
Comparez d’abord les entrées réelles, le checkpoint ou l’étiquette du modèle, la durée, la résolution, le prompt et tous les paramètres d’inférence. La version ouverte H3-Base et le service hébergé ne sont pas des chemins système identiques, il ne faut donc pas supposer une parité de sortie exacte.
Quelle route H3 convient à votre travail ?
| Votre profil | Commencez par | Pourquoi |
|---|---|---|
| Un créateur indépendant sans infrastructure ML | API MiniMax | Vous pouvez générer sans utiliser de serveur de modèles |
| Un développeur créant une fonctionnalité H3 | API MiniMax | Le cycle de vie des tâches s'adapte aux produits, aux files d'attente et aux tâches automatisées |
| Un ingénieur ou un chercheur ML | Poids ouverts | Vous pouvez examiner et utiliser directement les checkpoints H3-Base publiés |
| Un studio avec des exigences strictes en matière d'auto-hébergement | Poids ouverts | Vous contrôlez le déploiement et les flux de données environnants |
| Une équipe ne sait pas de quel itinéraire elle a besoin | API MiniMax, puis un test local | L'API établit une base de référence avant d'investir dans l'infrastructure |
Conservez des ressources sources, des prompts et des critères d’acceptation réutilisables. Vous pourrez ainsi comparer plus facilement les modes d’accès sans reconstruire le brief créatif à chaque fois.
Foire aux questions
Puis-je utiliser MiniMax H3 sans posséder de GPU ?
Oui. Utilisez l’API hébergée de MiniMax si vous ne souhaitez pas exploiter une infrastructure GPU. Vous aurez tout de même besoin d’une application ou d’un script qui crée les tâches, vérifie leur état et enregistre les résultats.
Les poids ouverts H3 sont-ils identiques au service H3 hébergé ?
Non. Les poids publics couvrent H3-Base FL2VA et Ref2VA. Le système complet utilise aussi les composants hébergés Context-IR et Regenerate-2K, absents du paquet actuel de poids ouverts.
H3-Base local peut-il générer le résultat officiel complet en 2K ?
Non. La chaîne H3-Base locale documentée produit du 768p. La chaîne officielle vers le 2K de MiniMax utilise Regenerate-2K, qui ne figure pas dans la publication publique actuelle.
Dois-je choisir FL2VA ou Ref2VA ?
Choisissez FL2VA pour générer à partir de texte ou fixer les images initiale et finale. Choisissez Ref2VA lorsque des images, une vidéo ou un fichier audio facultatif doivent guider l’identité, le style, le mouvement, la caméra, la voix ou le son.
Puis-je utiliser H3 pour des projets commerciaux ?
Peut-être, mais les conditions dépendent de votre mode d’accès et de votre situation. Consultez la licence communautaire pour les poids ouverts et les conditions actuelles de la plateforme pour l’usage hébergé. Vérifiez les restrictions territoriales, de revenus, d’attribution, de distribution et d’usage avant la publication.
Choisissez votre mode d’accès à MiniMax H3
Commencez par l’API lorsque vous devez obtenir rapidement un résultat fonctionnel. Choisissez les poids ouverts lorsque l’auto-hébergement ou l’accès au niveau du modèle répond à un besoin clairement identifié.
MiniMax H3 est désormais disponible dans DomoAI via Omni Reference.



