MiniMax H3 im Deep Dive: offene Gewichte, Preis, Qualität und Disruption
Faktengeprüfter Bericht zu Architektur und Lizenz der offenen H3-Gewichte, API-Preisen, Blindpräferenzen, Self-Hosting und dem Vergleich mit Seedance 2.5 und weiteren Videomodellen.
MiniMax H3 gehört zu den wenigen Videomodellen des Jahres 2026, die zugleich die Qualitätsgrenze und die Veränderbarkeit des Stacks verschieben. Es verarbeitet Text, Bilder, Video und Audio in einem Kontext, erzeugt 4–15 Sekunden Video mit nativem Stereo-Audio, bietet 768P- und 2K-Workflows und stellt H3-Base-Checkpoints zum Download bereit.
Die belastbare Schlussfolgerung ist genauer als „H3 ist Open Source und schlägt geschlossene Modelle“. H3 ist eine Open-Weight-Veröffentlichung auf Spitzenniveau mit ungewöhnlich günstiger API. Es ist jedoch kein vollständiges Open-Source-AI-System nach OSI-Maßstab, und aktuelle Blindpräferenzdaten belegen keinen universellen Sieg über Seedance 2.5. Seedance 2.5 hat weiterhin den stärkeren Vertrag für 30-Sekunden-Geschichten in einem Durchlauf und sehr große Referenzsammlungen. H3 verändert den Markt, weil Spitzenqualität, Änderungsrechte und niedrige Hostingpreise gleichzeitig verfügbar werden.
Offizielle Spezifikationen, Lizenzbedingungen, API-Preise und die Modelflare-Verfügbarkeit wurden am 30. August 2026 erneut geprüft. Die Arena-Schnappschüsse stammen vom 25.–26. August 2026 und verändern sich mit weiteren Stimmen.
Kurzurteil
- Offenheit: Zwei aufgabenbezogene BF16-Basischeckpoints, Modellkomponenten und Rezepte für SGLang, vLLM, diffusers und ComfyUI sind veröffentlicht. Das ist ausführbarer Code samt Gewichten, kein reines Paper-Versprechen.
- Preis: MiniMax nennt $0.08 pro generierter Sekunde bei 768P und $0.13 bei 2K. Offene Gewichte machen Inferenz nicht kostenlos, sondern verschieben Kosten auf GPUs, Betrieb, Speicher und Engineering.
- Ergebnis: Arena ordnet H3 und Seedance 2.5 überlappenden Spitzengruppen zu. H3 führt im Image-to-Video-Snapshot; Seedance liegt bei Text-to-Video und Bearbeitung numerisch leicht vorn, doch alle drei Konfidenzintervalle überlappen.
- Disruption: H3 verkleinert den lange bestehenden Qualitätsabstand zwischen herunterladbaren und geschlossenen Spitzenmodellen. Das kurz darauf erschienene H3 Max zeigt, dass Dritte die Modellschicht verändern können.
- Vorbehalt: Der offizielle 2K-Qualitätspfad nutzt weiterhin gehostetes H3-Context-IR und H3-Regenerate-2K; die Community-Lizenz enthält Gebiets-, Nutzungs-, Offenlegungs-, Namens- und Großkundenauflagen.
Was MiniMax H3 tatsächlich liefert
| Merkmal | Verifizierter H3-Vertrag |
|---|---|
| Offizielle API-Modell-ID | MiniMax-H3 |
| Ausgabedauer | 4–15 Sekunden, ganzzahlig |
| Ausgabe | 24-FPS-Video mit 32-kHz-Stereo-Audio |
| Auflösung | 768P als Basis; 2K über den offiziellen Generierungs- oder Regenerierungsworkflow |
| Erster/letzter Frame | Null, ein oder zwei Bilder |
| Referenzmodus | Bis zu 9 Bilder, 3 Videos und 3 Audios; insgesamt höchstens 12 Dateien |
| Referenzdauer | Video oder Audio je 2–15 Sekunden; jede Modalität insgesamt höchstens 15 Sekunden |
| Dialog | Offiziell stabil für 11 Sprachen ausgewiesen |
| Offene Checkpoints | FL2VA für Text und Start-/Endframe; Ref2VA für multimodale Referenzen |
| Kerngenerator | Dichter 33B H3-Omni-Transformer, Qwen3-VL-32B-Encoder sowie visuelle und Audio-VAEs |
| Empfohlene Runtimes | SGLang, vLLM, diffusers und ComfyUI |
Die API zeigt einen Modellnamen, das offene Paket enthält aber zwei spezialisierte Basischeckpoints. Wer Start-/Endframe-Erzeugung und beliebige multimodale Referenzen anbietet, muss Speicher und Kapazität für beide Pfade vorhalten.
Offenheitsprüfung: vier Ebenen statt eines Etiketts
| Ebene | Offen | Weiter begrenzt | Praktische Einordnung |
|---|---|---|---|
| Gewichte und Inferenzkomponenten | H3-Base-Familien, Prozessor, Tokenizer, Encoder, Omni Transformer, VisualVAE und AudioVAE | Großes Repository und erheblicher GPU-Bedarf im Produktivbetrieb | Lokale Ausführung und Fine-Tuning sind real möglich |
| Runtime-Ökosystem | Offizielle Rezepte für vier Runtimes, Downloads und reproduzierbare 768P-Beispiele | Zunächst Full Attention; Sparse-Attention-Inferenz ist erst angekündigt | Nutzbare Engineering-Oberfläche, noch nicht die effizienteste Form |
| Gesamte Produktpipeline | Lokales H3-Base erzeugt 768P-Audio-Video | H3-Context-IR ist gehostet; der offizielle 2K-Pfad ruft Context-IR- und Regenerierungs-APIs auf | Der beste offizielle Workflow ist hybrid, nicht vollständig lokal |
| Lizenz und Reproduzierbarkeit | Änderung, Derivate, Weitergabe und viele kommerzielle Nutzungen im Geltungsgebiet | Eigene Lizenz, ausgeschlossene Gebiete, Nutzungs- und Offenlegungspflichten, Genehmigung ab $20M Umsatz, kein vollständiges Trainingspaket | „Offene Gewichte unter Community-Lizenz“ ist genauer als bedingungslos „vollständig Open Source“ |
Nach der Open Source AI Definition verlangt Open Source AI die Freiheit, das System zu jedem Zweck zu verwenden, zu untersuchen, zu ändern und zu teilen, einschließlich ausreichender Dateninformationen und Trainingscodes als bevorzugter Änderungsform. H3 erfüllt diese Schwelle wegen Gebiets- und Nutzungsbeschränkungen sowie des unvollständigen Trainingspakets nicht.
Das mindert den technischen Beitrag nicht. Ein Spitzen-Videomodell mit echten Änderungs- und Weitergaberechten zu veröffentlichen, ist bedeutend. Die präzise Bezeichnung verhindert lediglich, dass Downloadbarkeit mit weltweiten, bedingungslosen Einsatzrechten verwechselt wird.
Architektur: weshalb sie zählt
H3 packt alle Modalitäten in eine Sequenz. Text läuft durch den H3-Encoder, visuelle Eingaben durch Encoder und VisualVAE, Audio durch AudioVAE. Ein Single-Stream Omni Transformer sagt Video- und Audio-Latents gemeinsam voraus; getrennte Decoder rekonstruieren Bild und Stereo-Ton.
Damit adressiert H3 einen typischen Produktionsfehler: Getrennte Modelle für Motivbezug, Bewegungsübertragung, Lippenbewegung, Soundeffekte und Upscaling können Identität oder Timing an jedem Übergang verlieren. H3 lernt Absicht, visuelle Identität, Bewegung, Schnittrhythmus, Stimme und Klangraum in einem Kontext.
Das Gesamtsystem hat drei Schichten:
- H3-Context-IR interpretiert freie multimodale Materialien und erstellt eine strukturierte Zwischenrepräsentation.
- H3-Base erzeugt daraus 768P-Audio-Video.
- H3-Regenerate-2K führt Basisergebnis und Originalkontext für mehr Details durch einen zweiten Generierungslauf.
Das erklärt sowohl die Qualitätsaussage als auch den Offenheitsvorbehalt: Die veröffentlichte Basis ist substanziell, Teile der Planung und des hochauflösenden Finishs bleiben Dienste.
H3 versus Seedance 2.5: gegensätzliche Wetten
| Entscheidung | MiniMax H3 | Seedance 2.5 | Produktionsfolge |
|---|---|---|---|
| Maximale native Erzählzeit | 15 Sekunden | 30 Sekunden plus Erweiterungen | Seedance hält vor dem Zusammenschnitt einen längeren Bogen |
| Referenzsammlung | 12 Dateien: bis 9 Bilder, 3 Videos, 3 Audios | Bis 30 Bilder, 10 Videos, 10 Audios | Seedance passt zu komplexen Kampagnen mit mehr Figuren, Produkten, Stimmen und Bewegungen |
| Ausgabeprofil | 768P-Basis und 2K-Workflow; natives Stereo | Gehostete gemeinsame Audio-/Videoerzeugung; zitierte APIs bieten 480p/720p | H3 betont Auflösung und Portabilität, Seedance Dauer und Kontrollumfang |
| Bearbeitung | Multimodale Referenzen und natürlichsprachliche Videobearbeitung | Timestamp-Änderungen, Greenscreen, Kamera- und Referenzbearbeitung | Seedance dokumentiert mehr Produktionskontrollen; H3 bietet die veränderbare Basis |
| Gewichte | H3-Base herunterladbar | Geschlossen | H3 lässt sich im Lizenzrahmen selbst hosten, feinabstimmen, quantisieren und nachtrainieren |
| Lizenz | MiniMax H3 Community License | Hosted-Service-Bedingungen | H3 senkt technischen Lock-in, beseitigt aber keine Rechtsprüfung |
| Gehosteter Listenpreis | $0.08/s 768P, $0.13/s 2K bei MiniMax | etwa $0.473/s 720p bei fal; $0.36/s 720p bei Modelflare | Deutlicher Preisvorteil für H3, aber keine identischen Routen oder Auflösungen |
Seedance 2.5 will mehr Arbeit einer professionellen Timeline in einen gehosteten Aufruf ziehen. H3 macht einen 15-Sekunden-Spitzenkern billig, herunterladbar und erweiterbar. Studios können beides nutzen: Seedance für lange referenzreiche Mastershots, H3 für kurze Varianten, kontrollierte Änderungen oder privates Fine-Tuning.
Was blinde menschliche Präferenzen aussagen
Arena wertet anonyme Paarvergleiche aus. Das ist breiter als eine Herstellerdemo, bleibt aber ein bewegliches Präferenzsignal und kein kontrollierter Produktionsbenchmark.
| Arena-Snapshot | MiniMax H3 | Seedance 2.5 720p | Gemini Omni 1.1 Flash | Vorsichtige Lesart |
|---|---|---|---|---|
| Text-to-Video, 25. Aug. | 1460±10, Rangspanne 4–7 | 1476±14, 3–7 | 1515±16, 1–3 | H3 und Seedance überlappen; Gemini führt |
| Image-to-Video, 25. Aug. | 1494±6, 1–3 | 1483±12, 1–4 | 1488±11, 1–4 | Alle drei liegen in derselben statistischen Spitzengruppe |
| Videobearbeitung, 26. Aug. | 1392±19, 1–5 | 1410±26, 1–3 | 1367±15, 3–5 | Seedance liegt numerisch höher, die Intervalle überlappen stark |
Damit ist „Spitzenniveau“ begründet, nicht „H3 schlägt Seedance 2.5“. Die Ranglisten kennen weder konkrete Prompts und Rechte noch Markenregeln, Fehlerbudgets oder Abnahmekriterien. Seedance hat in diesen Momentaufnahmen zudem weniger Stimmen als ältere Modelle.
Aufgabenbezogen ist H3 besonders glaubwürdig für bildkonditionierte Erzeugung und Bearbeitung. Seedance behält den Spezifikationsvorteil für lange, referenzintensive Produktionen. Gemini Omni zeigt, dass ein günstiges geschlossenes Modell bei Text-to-Video führen kann.
H3 im Feld herunterladbarer Modelle
Arena gruppiert H3 mit herunterladbaren Modellen, obwohl die Lizenzen nicht gleichwertig sind. Der Qualitätsabstand in denselben Schnappschüssen fällt außergewöhnlich groß aus.
| Herunterladbares Modell | Lizenzlabel in Arena | Text-to-Video | Image-to-Video |
|---|---|---|---|
| MiniMax H3 | MiniMax H3 Community License | 1460±10 | 1494±6 |
| Hunyuan Video 1.5 | Tencent community license | 1169±16 | 1197±16 |
| Kandinsky 5.0 T2V Pro | MIT | 1172±20 | — |
| Wan 2.2 A14B | Apache 2.0 | 1132±15 | 1170±10 |
| LTX-2 19B | LTX community license | 1152±8 | 1155±5 |
Ein Elo-Wert entscheidet nicht jeden Shot. Entscheidend ist, dass Downloadbarkeit bisher meist einen sichtbaren Qualitätsabschlag bedeutete, H3 aber in derselben Präferenzgruppe wie die besten geschlossenen Systeme erscheint. Das verändert Beschaffung, Forschung und Fallback-Strategien auch ohne Self-Hosting.
Preis: die Schlagzeile stimmt, der Nenner zählt
| Am 30. Aug. geprüfte Route | Auflösung | Preis je generierter Sekunde | 15-Sekunden-Ausgabe | Wichtige Ausschlüsse |
|---|---|---|---|---|
| Offizielle MiniMax-H3-API | 768P | $0.08 | $1.20 | Referenzvideo und zusätzliche Bilder können Mehrkosten erzeugen |
| Offizielle MiniMax-H3-API | 2K | $0.13 | $1.95 | Context-IR wird separat nach Tokens berechnet |
| Modelflare Seedance 2.5 | 480p | $0.18 | $2.70 | Benötigt seedance-stable; maximal 30 Sekunden |
| Modelflare Seedance 2.5 | 720p | $0.36 | $5.40 | Andere Providerroute und geringere Auflösung als H3 2K |
| fal Seedance 2.5, 16:9-Schätzung | 720p | etwa $0.473 | etwa $7.10 | Tokenformel hängt von Bildfläche ab; Referenzvideo ändert Abrechnung |
| Google Gemini Omni Flash | 720p | etwa $0.10 | $1.50 | Geschlossen; Eingabetokens und höhere Auflösung separat |
Bei H3 sind Audioreferenzen und die ersten fünf Bilder kostenlos; jedes weitere Bild kostet $0.04. Eingabevideo wird nach Dauer zum Satz der gewählten Ausgabeauflösung berechnet. Die Regenerierung von 768P auf 2K kostet $0.05 je Ausgabesekunde. Referenzreiche Jobs können daher deutlich über dem Schlagzeilenpreis liegen.
Die effektiven Modelflare-Preise für Seedance 2.5 betragen nach dem Multiplikator der Gruppe seedance-stable $0.18/s bei 480p und $0.36/s bei 720p. Das ist günstiger als die zitierte fal-Route, aber teurer als H3 offiziell. Es ist ein Budgetvergleich, kein Gleichwertigkeitsnachweis.
Die richtige Kennzahl ist der Preis je akzeptierter Sekunde: erfolgreiche und fehlgeschlagene Generationen, bezahlte Referenzen, Wiederholungen, menschliche Bearbeitung und nutzbare Dauer geteilt durch akzeptierte Sekunden. Ein nominell viermal teureres Modell kann gewinnen, wenn es genug Ausschuss oder Nacharbeit vermeidet.
Warum Self-Hosting nicht kostenlos ist
Das offene Paket verändert Kontrolle, nicht Physik.
- Der Kern ist ein dichter 33B-Generator mit vollständigem Qwen3-VL-32B-Encoder und mehreren VAEs. Offizielle SGLang-Beispiele verwenden vier GPUs je Serving-Variante.
- Die erste Version nutzt Full Attention; Sparse Attention soll später veröffentlicht werden.
- Zwei Checkpoint-Familien erhöhen Speicher-, Warmkapazitäts-, Lade-, Observability-, Moderations- und Upgradeaufwand.
- Lokales H3-Base liefert 768P. Der offizielle 2K-Look verlangt gehostete Dienste oder eine separat geprüfte Community-Pipeline.
- GPU-Auslastung entscheidet die Kosten. Bei sprunghafter Last kann ungenutzte lokale Kapazität teurer sein als die API.
Self-Hosting lohnt sich bei vertraulichen Rohdaten, wiederholbaren LoRA-Stilen, stetiger Auslastung oder notwendigen Inferenzänderungen. Für Experimente, Lastspitzen und das offizielle 2K-Finish bleibt die API rational.
Wo H3 tatsächlich disruptiv ist
- Offenheit wird eine Qualitätsentscheidung statt nur Ideologie. Ein Downloadmodell bedeutet nicht automatisch zweite Leistungsklasse.
- Spitzenpreise geraten unter Druck. $0.13/s für offizielles 2K zwingt geschlossene Systeme, Aufschläge durch Länge, Kontrolle, Zuverlässigkeit oder Integration zu begründen.
- Dritte können die Modellschicht ändern. Quantisierung, LoRA, Post-Training, neue Scheduler und spezialisierte Inferenz hängen nicht von einer Roadmap ab.
- Hybride Architektur wird praktisch. Sensible oder wiederholte Basiserzeugung bleibt lokal; Context-IR, Regenerierung oder Spitzenkapazität werden gezielt gekauft.
- Der Derivatzyklus verkürzt sich. fal veröffentlichte im selben Monat H3 Max als nachtrainierte und inferenzoptimierte Variante. fal meldet fünf Sekunden 768P in unter drei Sekunden; Artificial Analysis ordnet das Modell der aktuellen Text-to-Video-Spitzengruppe zu. Die Geschwindigkeit ist eine Anbieterangabe, das Derivat selbst ist unabhängig sichtbar.
Der letzte Punkt reicht am tiefsten: Nur eine veränderbare Basis erlaubt einem anderen Team, Qualität, Latenz und Kosten zugleich auf Modell- und Systemebene anzugreifen.
Wo die Disruption endet
- Die Community-Lizenz ist nicht OSI-genehmigt und schließt EU, Vereinigtes Königreich, Südkorea und USA ohne separate Lizenz aus.
- Kommerzielle Produkte oberhalb von $20 Millionen Jahresumsatz benötigen vorherige schriftliche Genehmigung; Oberflächen müssen „MiniMax H3“ sichtbar anzeigen.
- Öffentlich erzeugte Inhalte unterliegen Offenlegungspflichten; nachgelagerte Dienste müssen Schutzmaßnahmen und Nutzungsgrenzen umsetzen.
- H3-Context-IR und die offizielle 2K-Regenerierung sind nicht Teil der offenen Veröffentlichung.
- Vollständige Trainingsdateninformationen und ausreichender Trainingscode fehlen.
- Offene Gewichte lösen Einwilligungs-, Ähnlichkeits-, Stimmen-, Urheberrechts-, Markensicherheits- und Prüfpflichten nicht.
H3 verändert den technischen und wirtschaftlichen Stack stärker, als es Anbieterabhängigkeit auflöst. MiniMax öffnet die wertvolle Basis, behält aber gehostete Qualitätsmodule, kommerzielle API und Lizenzkontrolle.
Welches Modell passt zu welcher Einschränkung
| Hauptanforderung | Besserer Startpunkt | Warum |
|---|---|---|
| Durchgehende Erzählung von 16–30 Sekunden | Seedance 2.5 | Doppelte Einzeldauer und dokumentierte Erweiterungen |
| Mehr als 12 gemischte Referenzen | Seedance 2.5 | Bis zu 50 Dateien statt H3-Limit 12 |
| Self-Hosting, Fine-Tuning oder eigene Inferenz | H3 | Herunterladbare Basis und mehrere Runtimes |
| Günstiges kurzes 2K-Video | H3 | Offiziell $0.13/s und starke Präferenzdaten |
| Image-to-Video-Präferenzsignal | H3, dann prüfen | Aktuell Erster, aber überlappende Spitzenintervalle |
| Timestamp- und Greenscreen-Workflow | Seedance 2.5 | Expliziterer professioneller Bearbeitungsvertrag |
| Dialogbasierte geschlossene API | Gemini Omni 1.1 Flash | Native Gesprächsbearbeitung, T2V-Führung und etwa $0.10/s bei 720p |
| Kommerzielle Shot- und Elementkontrolle | Kling-3-Familie | Explizitere Storyboard-, Element- und Bewegungssteuerung |
| Bestehender Google- oder OpenAI-Stack | Gemini/Veo oder Sora | Identität, Sicherheit, Abrechnung und Tools können wichtiger als Portabilität sein |
„Besserer Startpunkt“ ist kein endgültiger Sieger. Vor Routingänderungen muss das konkrete Lieferobjekt kontrolliert getestet werden.
Ein besseres Evaluationsprotokoll
- 12–20 autorisierte Briefings zu Dialog, Produkttext, Körperbewegung, Figurenkontinuität, Kamera, Bildkonditionierung, Referenzvideo und präzisen Änderungen auswählen.
- Dauer, Seitenverhältnis, Auflösungsklasse, Prompt, Referenzen und Audio so weit wie vertraglich möglich festlegen.
- Nicht unterstützte Parameter dokumentieren, statt einem Modell unbemerkt die leichtere Aufgabe zu geben.
- Alle bezahlten Versuche, Moderationsfehler, Timeouts und unbrauchbaren Ergebnisse behalten; nicht nur den besten Seed bewerten.
- Verblindet Identität, Anweisungsbefolgung, Bewegung/Physik, Text, Audiosynchronität, Kontinuität, lokale Bearbeitung und Nutzbarkeit bewerten.
- Warteschlange, Generierungszeit, Wiederholungen, Korrekturminuten, Ein-/Ausgabekosten, Speicher und Egress messen.
- Erstversuch-Nutzbarkeit und Kosten je akzeptierter Sekunde samt Intervallen berichten; keine undurchsichtige Gesamtnote bilden.
- Nach Änderungen an Modell, Provider, Prompt-Expander, Sicherheit oder Preis einen kleineren Sentinel-Satz erneut ausführen.
Für Self-Hosting gelten identische Annahmen zu Energie, reservierten GPUs, Auslastung, Deploymentarbeit und Wiederherstellung. Eine vollständige API-Rechnung nur mit lokalem Strom zu vergleichen, ist kein gültiger TCO.
Verfügbarkeitsgrenze bei Modelflare
Bei der Prüfung des Produktionskatalogs am 30. August bot Modelflare keine exakte Modell-ID MiniMax-H3 oder hailuo-03. Der Artikel behauptet nicht, dass H3 derzeit über einen Modelflare-API-Key aufrufbar ist.
seedance-2.5 ist dagegen in seedance-stable über die asynchrone OpenAI-kompatible Video-API verfügbar: effektiv $0.18/s bei 480p und $0.36/s bei 720p. Vor der Generierung die Seedance-2.5-API-Anleitung und die aktuelle Seedance-2.5-Preisseite prüfen.
Wird H3 später ergänzt, sind exakte Modell-ID, Endpoint, Referenzfelder, Auflösungen, Gruppen, effektiver Preis und eine real abgerechnete Aufgabe nachzutragen. Upstream-Konfiguration oder Fremdanbieter-Alias allein beweisen keine Verfügbarkeit.
Häufig gestellte Fragen
Ist MiniMax H3 wirklich Open Source?
MiniMax bezeichnet es so und liefert reale Gewichte, Komponenten, Rezepte, Änderungs- und Weitergaberechte. Nach strenger OSI-Definition ist wegen Gebiets-/Nutzungsgrenzen und fehlendem vollständigem Trainingspaket „Open Weight unter MiniMax H3 Community License“ die sicherere Formulierung.
Schlägt H3 Seedance 2.5?
Nicht universell. H3 liegt im aktuellen Image-to-Video-Snapshot numerisch vorn, Seedance 2.5 bei Text-to-Video und Bearbeitung. Intervalle und Rangspannen überlappen; Seedance hat zudem den stärkeren 30-Sekunden-/50-Referenzen-Vertrag.
Kann H3 vollständig offline 2K erzeugen?
Das veröffentlichte H3-Base liefert 768P. Das offizielle 2K-Rezept kombiniert lokale Basisinferenz mit gehosteten H3-Context-IR- und H3-Regenerate-2K-APIs. Eine lokale Community-Alternative muss separat belegt werden.
Ist lokales H3 günstiger als die API?
Das hängt von Auslastung, Hardware, Optimierung, beiden Checkpoint-Familien, Betrieb und Qualitätsziel ab. Bei geringem oder sprunghaftem Volumen ist die API meist einfacher; Dauerlast, Datenschutz oder eigenes Fine-Tuning können Self-Hosting rechtfertigen.
Fazit
MiniMax H3 kombiniert drei selten gemeinsame Eigenschaften: menschliche Präferenzwerte auf Spitzenniveau, einen offiziellen Hostingpreis ab $0.08 je generierter Sekunde und herunterladbare, veränderbare Gewichte. Damit gehört ein Open-Weight-Modell in die primäre Auswahl und nicht nur in die Datenschutz- oder Ideologie-Nische.
Die Grenzen sind ebenso wichtig. H3 ist ein hybrides Open-Core-System mit restriktiver Community-Lizenz, hohem Hardwarebedarf und gehosteten Bausteinen im offiziellen 2K-Pfad. Seedance 2.5 bietet weiter den ambitionierteren Hostingvertrag für 30-Sekunden-Erzählungen und 50 Referenzen; Gemini Omni bleibt ein starker günstiger geschlossener Wettbewerber.
Nach Engpass entscheiden: H3 für Portabilität, Änderungen, Kurzformökonomie oder bildkonditionierte Qualität; Seedance für lange Kontinuität und große Referenzflächen. Beide nach akzeptierter Ausgabe beurteilen, nicht nach Launch-Reels.
Offizielle Quellen und Aktualisierungsprotokoll
Primär- und Messquellen:
- MiniMax: H3-Vorstellung
- MiniMax: offene H3-Gewichte und Architektur
- Offizielles MiniMax-H3-Modellrepository
- MiniMax H3 Community License
- MiniMax API: Vertrag zur Videogenerierung
- MiniMax API-Preise
- ByteDance Seed: Seedance-2.5-Vorstellung
- Google: Gemini-Omni-Flash-Modellvertrag
- Google: Gemini-API-Preise
- Arena Text-to-Video
- Arena Image-to-Video
- Arena Videobearbeitung
- Open Source Initiative: Open Source AI Definition 1.0
- fal: Ankündigung des H3-Max-Derivats
Aktualisierung:
- 30. August 2026: Erstveröffentlichung. Architektur, offenes Paket, Lizenz und API-Preise von H3, Seedance-2.5-Vertrag, Livepreise und Verfügbarkeit von Modelflare sowie datierte Arena-Snapshots wurden erneut geprüft. Das Titelbild ist eine synthetische redaktionelle Illustration, keine H3-Ausgabe, kein Benchmark und keine echte Produktoberfläche.