MiniMax H3 kann über öffentliche H3-Base-Gewichte oder die gehostete API von MiniMax verwendet werden. Wähle Open Weights, wenn du selbst gehostete Inference und Kontrolle auf Modellebene benötigst. Wähle die API, wenn du innerhalb einer App oder eines automatisierten Workflows generieren möchtest, ohne Modellserver zu betreiben.
Der beste Zugangsweg hängt von der Aufgabe ab, die du lösen möchtest. Dieser Leitfaden zeigt, wie du mit jeder verfügbaren Option beginnen und sie dann mit einem wiederholbaren Test vergleichen.
Open Weights oder API: Welchen H3-Zugangsweg solltest du wählen?
| Wähle | Am besten für | Du verwaltest | Haupteinschränkung |
|---|---|---|---|
| Offene H3-Base-Gewichte | ML-Teams, Forscher, benutzerdefinierte Pipelines und selbst gehostete Bereitstellungen | Modelldateien, Rechenleistung, Abhängigkeiten, Inference, Speicherung, Sicherheit und Aktualisierungen | Die öffentlichen Gewichte decken H3-Base bei 768p ab, nicht das vollständig gehostete H3-System |
| MiniMax H3-API | Apps, Batch-Jobs, Prototypen und automatisierte Content-Workflows | API-Anmeldeinformationen, Anfragen, Task-Status, Wiederholungsversuche, Speicher, Budgets und Produktlogik | Du nutzt den gehosteten Dienst von MiniMax, anstatt den Modellserver zu steuern |
Nutze Open Weights, wenn Modelldateien innerhalb der von dir kontrollierten Infrastruktur ausgeführt werden müssen. Diese Route eignet sich auch für Forschung, benutzerdefinierten Inference-Code oder lokale Pipeline-Experimente.
Nutze die MiniMax-API, wenn du eine Funktion bereitstellen, Stapel automatisieren oder H3 testen möchtest, ohne GPU-Infrastruktur zu betreiben. Du musst den Workflow immer noch um jeden Generierungsauftrag herum aufbauen.
Wenn beide Zugangswege passen, beginne mit der API. Die API bietet einem Entwicklungsteam normalerweise den kürzesten Weg zu einer funktionierenden H3-Anfrage. Gehe nur dann zu Open Weights über, wenn das Selbst-Hosting eine bestimmte Anforderung erfüllt.
So führst du H3-Base mit Open Weights aus
MiniMax hat zwei H3-Base-Checkpoint-Familien veröffentlicht. FL2VA kümmert sich um die Textgenerierung und die Anleitung zum ersten, letzten oder ersten und letzten Frame. Ref2VA verwendet Referenzbilder, Videos und optional Audio, um das Ergebnis zu steuern.
Die öffentliche Version ist nur die Basisstufe des größeren H3-Systems. H3-Base erzeugt eine audiovisuelle Ausgabe mit 768p. Die von MiniMax gehosteten Context-IR- und Regenerate-2K-Komponenten sind nicht im aktuellen Open-Weight-Paket enthalten.
Wähle den Checkpoint, bevor du Dateien herunterlädst
Wähle den Checkpoint aus der Eingabe aus, die du tatsächlich verwenden möchtest:
| Deine Eingabe | Checkpoint | Typische Aufgabe |
|---|---|---|
| Nur Text | H3-Base FL2VA | Generiere eine Szene aus einer schriftlichen Beschreibung |
| Ein Eröffnungsbild | H3-Base FL2VA | Animiere von einem festen ersten Frame aus |
| Ein Schlussbild | H3-Base FL2VA | Generiere einen festen Endframe |
| Start- und Endbild | H3-Base FL2VA | Erstelle einen Übergang zwischen zwei Endpunkten |
| Bilder, Videos und optionale Audioreferenzen | H3-Base Ref2VA | Steuere Identität, Stil, Bewegung, Kameraverhalten, Stimme oder Ton |
Lade Ref2VA nicht herunter, nur weil es fortgeschrittener klingt. FL2VA ist die direkte Wahl für Text- und Endpunkt-Frame-Jobs. Ref2VA unterstützt einen anderen Eingabeworkflow.
Erstelle einen lokalen Workflow, bevor du benutzerdefinierte Komponenten hinzufügst
- Lies die Lizenz- und Model Card. Bestätige, dass deine Nutzung, dein Standort, dein Verteilungsplan und deine Organisation den veröffentlichten Bedingungen entsprechen.
- Wähle einen unterstützten Inference-Pfad. MiniMax listet SGLang, vLLM, Diffusers und ComfyUI im offiziellen H3-Repository.
- Lade den passenden Checkpoint und die erforderlichen Komponenten herunter. Halte FL2VA- und Ref2VA-Dateien klar getrennt.
- Befolge das offizielle Setup für die von dir gewählte Runtime. Pinne die Softwareversionen, die zu deinem ersten erfolgreichen Ergebnis führen.
- Führe einen einfachen Job aus. Speichere den Prompt, die Eingaben, den Workflow, den Seed (sofern verfügbar) und die Ausgabe.
- Erfasse die Ressourcennutzung. Beachte die Startzeit, den VRAM-Spitzenwert, die Generierungszeit, den Speicher und Ausfälle auf deiner eigenen Hardware.
Vermeide es, gleichzeitig mit Community-Knoten, Adaptern, Quantisierungsänderungen und einem komplexen Referenzpaket zu beginnen. Wenn der erste Lauf fehlschlägt, erschweren zu viele Variablen die Suche nach der Ursache.
Was dir die lokale Kontrolle bietet und was nicht
Durch Selbsthosting kannst du die Bereitstellungsumgebung, den umgebenden Code, die Dateiverarbeitung und kompatible Inference-Einstellungen steuern. Außerdem kannst du damit deine eigene Vorverarbeitungs- und Überprüfungspipeline erstellen.
Durch diese Kontrolle wird H3-Base nicht zum vollständigen gehosteten System. Ein benutzerdefinierter Präprozessor ist nicht die Context-IR-Implementierung von MiniMax. Ein separater Upscaler ist nicht die offizielle Regenerate-2K-Stufe.
Die lokale Bereitstellung verlagert auch Kosten und Verantwortung auf dich. Rechenleistung, Speicher, Entwicklungszeit, Überwachung, Sicherheitsmaßnahmen und fehlgeschlagene Läufe sind immer noch wichtig. Der Datenschutz hängt von deinen Protokollen, Zugriffsregeln, der Asset-Speicherung und den Komponenten von Drittanbietern ab.
So verwende MiniMax H3 über die API
Die API-Route entfernt das Modellhosting, aber nicht die Anwendungsarbeit. Die H3-Generierung wird als asynchrone Aufgabe ausgeführt: Erstelle die Aufgabe, behalte ihre ID, überprüfe ihren Status und rufe die fertige Ausgabe ab.
Beginne mit dem minimalen API-Lebenszyklus
- Erstelle ein MiniMax-Plattformkonto und einen API-Schlüssel. Speichere den Schlüssel außerhalb des clientseitigen Codes und öffentlicher Repositorys.
- Wähle ein Eingabemuster. Beginne mit einer text- oder bildbasierten Anfrage, bevor du mehrere Referenzen hinzufügst.
- Erstelle eine Aufgabe zur Videogenerierung. Verwende das Modell
MiniMax-H3und füge einen nicht leeren Prompt hinzu. - Speichere die zurückgegebene Aufgaben-ID. Verknüpfe die ID mit dem Nutzer, den Eingabedateien und den Anfrageeinstellungen.
- Frage den Task-Status-Endpunkt ab. Behandle die Status „In Bearbeitung“, „Erfolgreich“ und „Fehler“ getrennt.
- Rufe das Ergebnis ab und speichere es. Lade die Ausgabe in den von dir kontrollierten Speicher herunter, anstatt den zurückgegebenen Speicherort als dauerhaft zu behandeln.
Der offizielle Leitfaden zur Videogenerierung von MiniMax enthält die aktuellen Anfragefelder und Endpunktdetails. Verwende das aktuelle Schema, anstatt eine alte Nutzlast aus einem Tutorial eines Drittanbieters zu kopieren.
Füge Produktionsschutzmaßnahmen hinzu, nachdem die erste Anforderung funktioniert hat
Sobald eine Anfrage durchgehend abgeschlossen ist, füge die umgebenden Steuerelemente hinzu:
- Prüfe Prompts und Medien, bevor du eine kostenpflichtige Aufgabe einreichst.
- Verhindere doppelte Übermittlungen, wenn ein Benutzer eine Aktualisierung durchführt oder es erneut versucht.
- Lege ein Abfrageintervall und eine Richtlinie für die maximale Wartezeit fest.
- Trenne Anforderungsfehler von Generierungsfehlern.
- Speichere Aufgaben-IDs, damit unterbrochene Sitzungen ihre Aufgaben wiederherstellen können.
- Verfolge fehlgeschlagene Versuche und die endgültigen Kosten pro nutzbarem Ergebnis.
- Wende deine eigenen Zugriffs-, Moderations-, Aufbewahrungs- und Löschregeln an.
Skaliere die Parallelität nicht, bevor du einen fehlgeschlagenen Job sauber wiederherstellen kannst. Ein erfolgreicher API-Aufruf ist nur der Anfang eines zuverlässigen Benutzerworkflows.
Vergleiche beide Routen mit einem kleinen H3-Test
Für einen fairen Routenvergleich sind dieselben Ausgangs-, Eingabeaufforderungs-, Ziel- und Akzeptanzkriterien erforderlich. Halte den ersten Test kurz und optisch einfach.
Wiederverwendbare Testkarte
Quellbild: Ein lizenziertes 16:9-Bild einer mattweißen Keramiktasse auf einem Holztisch. Der Griff und das aufgedruckte Etikett müssen deutlich sichtbar sein.
Prompt:
Behalte die Tasse, den Henkel, das Etikett, den Tisch und den Hintergrund aus dem Eingabebild bei. Dampf steigt langsam aus der Tasse auf, während die Kamera sanft hineingedrückt wird. Das Etikett bleibt lesbar. Audio enthält einen ruhigen Raumton und ein leises Keramikklirren. Keine Musik.
Akzeptanzkriterien:
- Die Becherform und der Henkel bleiben stabil.
- Das gedruckte Etikett bleibt lesbar.
- Dampf bewegt sich, ohne das Tassendesign zu verändern.
- Die Aufnahme erfolgt mit einem langsamen Einschieben statt mit mehreren Kamerabewegungen.
- Der Clip enthält einen Raumton und einen Keramikklinker.
- Es erscheint keine Musik.
Verwende die nächstgelegene gemeinsame Dauer und das nächstgelegene Seitenverhältnis, die in beiden Routen verfügbar sind. Wenn eine Route nicht mit einer Einstellung übereinstimmen kann, notiere den Unterschied, anstatt das kreative Ziel zu ändern.
Notiere das Ergebnis, nicht nur die Renderzeit
| Messen | Was soll ich aufschreiben? |
|---|---|
| Rüstzeit | Zeit von einem leeren Projekt bis zum ersten angenommenen Auftrag |
| Generationszeit | Zeit vom angenommenen Auftrag bis zur abgeschlossenen Ausgabe |
| Misserfolge | Übermittlungsfehler, Laufzeitfehler, fehlgeschlagene Aufgaben und unbrauchbare Dateien |
| Wiederholungen | Anzahl der benötigten zusätzlichen Generationen |
| Kosten | Tatsächliche Rechen- oder API-Kosten für alle Versuche |
| Visuelles Ergebnis | Ob Becher, Henkel, Etikett, Dampf und Kamerabewegung die Kriterien erfüllen |
| Audioergebnis | Ob der Raumton, das Klirren und die musiklose Anweisung halten |
| Nacharbeit | Zuschneiden, Reparieren, Speichern, Hochskalieren oder Bearbeiten ist weiterhin erforderlich |
Notiere bei einem lokalen Lauf auch Hardware, Runtime, Softwareversionen, Präzision oder Quantisierung, Spitzen-VRAM und Checkpointquelle. Zeichne für einen API-Lauf Task-Status, Antwortfehler und Speicherverhalten auf.
Ein Ergebnis kann nicht beweisen, dass eine Route immer schneller oder besser ist. Es kann aufdecken, welche Route zu deinem aktuellen Team, deiner Infrastruktur und deiner Toleranz gegenüber Fehlversuchen passt.
Behebe die häufigsten Setup-Probleme
Der lokale Workflow wird nicht geladen
Prüfe, ob der Checkpoint zum Workflow passt. Vergleiche dann Dateinamen, Speicherorte und Abhängigkeitsversionen mit dem offiziellen Repository. Entferne Knoten und Optimierungen von Drittanbietern, bis der Basisworkflow ausgeführt wird.
Die API akzeptiert die Anfrage, aber deine App verliert das Ergebnis
Behalte die Aufgaben-ID bei, sobald MiniMax sie zurückgibt. Nach einer Aktualisierung oder einem vorübergehenden Verbindungsfehler sollte deine Schnittstelle die Statusprüfungen wieder aufnehmen. Kopiere fertige Medien in deinen eigenen Speicher.
Die Ausgabe ignoriert einen Teil der Prompt
Reduziere den Test auf ein Thema, eine Aktion, eine Kamerabewegung und ein Audioziel. Füge die Komplexität erst hinzu, wenn die kleinere Version funktioniert. Gib für die referenzbasierte Generierung jeder Quelle eine klare Aufgabe, anstatt jede Quelle zu bitten, alles zu kontrollieren.
Lokale und API-Ergebnisse stimmen nicht überein
Vergleiche zunächst die tatsächlichen Eingaben, die Checkpoint- oder Modellbezeichnung, die Dauer, die Auflösung, den Prompt und alle Inference-Einstellungen. Die offene H3-Base-Version und der gehostete Dienst sind keine identischen Systempfade, daher sollte nicht von einer exakten Ausgabeparität ausgegangen werden.
Welche H3-Route passt zu deiner Arbeit?
| Du bist | Beginne mit | Warum |
|---|---|---|
| Ein unabhängiger Entwickler ohne ML-Infrastruktur | MiniMax-API | Du kannst generieren, ohne einen Modellserver zu betreiben |
| Ein Entwickler, der eine H3-Funktion erstellt | MiniMax-API | Der Aufgabenlebenszyklus passt zu Produkten, Warteschlangen und automatisierten Jobs |
| Ein ML-Ingenieur oder Forscher | Offene Gewichte | Du kannst die freigegebenen Base-Checkpoints direkt inspizieren und bedienen |
| Ein Studio mit strengen Anforderungen an das Selbsthosting | Offene Gewichte | Du steuerst die Bereitstellung und den umgebenden Datenfluss |
| Ein Team, das sich nicht sicher ist, welche Route es braucht | MiniMax-API, dann ein lokaler Test | Die API stellt eine funktionierende Basis her, bevor du in die Infrastruktur investierst |
Halte deine Quell-Assets, Prompts und Akzeptanzkriterien portabel. Das erleichtert den Vergleich der Zugangswege, ohne das Kreativ-Briefing jedes Mal neu zu erstellen.
Häufig gestellte Fragen
Kann ich MiniMax H3 verwenden, ohne eine GPU zu besitzen?
Ja. Nutze die gehostete API von MiniMax, wenn du keine GPU-Infrastruktur betreiben möchtest. Du benötigst weiterhin eine Anwendung oder ein Skript, das Aufgaben erstellt, deren Status überprüft und die Ergebnisse speichert.
Sind die H3 Open Weights mit denen des gehosteten H3-Dienstes identisch?
Nein. Die öffentlichen Gewichte umfassen H3-Base FL2VA und Ref2VA. Das Gesamtsystem nutzt außerdem gehostete Context-IR- und Regenerate-2K-Komponenten, die nicht im aktuellen Open-Weight-Paket enthalten sind.
Kann die lokale H3-Base das vollständige offizielle 2K-Ergebnis generieren?
Nein. Der dokumentierte lokale H3-Base-Pfad erzeugt eine 768p-Ausgabe. Der offizielle 2K-Pfad von MiniMax verwendet Regenerate-2K, das in der aktuellen öffentlichen Version nicht enthalten ist.
Soll ich FL2VA oder Ref2VA wählen?
Wähle FL2VA für die Textgenerierung oder feste erste und letzte Frames. Wähle Ref2VA, wenn Bilder, Videos oder optional Audio die Identität, den Stil, die Bewegung, das Kameraverhalten, die Stimme oder den Ton bestimmen sollen.
Kann ich H3 für kommerzielle Projekte verwenden?
Möglicherweise, aber die Bedingungen hängen von deinem Zugangsweg und den Umständen ab. Lies die Community-Lizenz für Open Weights und die aktuellen Plattformbedingungen für die gehostete Nutzung. Prüfe vor der Veröffentlichung Gebiets-, Umsatz-, Zuordnungs-, Vertriebs- und Nutzungsbeschränkungen.
Wähle deinen Zugang zu MiniMax H3
Beginne mit der API, wenn es darauf ankommt, schnell zu einem Arbeitsergebnis zu gelangen. Wähle Open Weights, wenn Selbsthosting oder Zugriff auf Modellebene eine von dir benennbare Anforderung erfüllt.
MiniMax H3 ist jetzt in DomoAI über Omni Reference verfügbar.



