Was ist MiniMax H3 Turbo?
Kein offizielles MiniMax-Modell, sondern eine Familie von Community-LoRAs. Sie destillieren H3, um Video und synchrones Stereo-Audio in etwa 4–8 statt rund 20 Sampling-Schritten zu erzeugen. Die Hauptlinien kommen von LightX2V/ModelTC und larryvrh, ergänzt durch ComfyUI-Konvertierungen etwa von Kijai.
Welche H3-Turbo-LoRA sollte ich wählen?
In diesem Vergleich ist LightX2V Ref2VA die speziell für Referenz-zu-Video destillierte Variante. Für die meisten anderen Aufgaben ist larryvrh v4 step-600 EMA mit 6–8 Schritten ein Einstieg. Für schnelle native 1344×768-Ausgabe kommt LightX2V 768p mit vier Schritten infrage.
Sind vier Schritte wirklich fünfmal schneller?
Die Zahl betrifft nur das Sampling. Modellladen, Text-Encoding sowie VAE- und Audio-Decoding verkürzen sich nicht im gleichen Verhältnis. Vergleiche die Gesamtzeit pro nutzbarem Clip einschließlich verworfener Versuche.
Soll ich vier, sechs oder acht Schritte nutzen?
Vier, wenn Geschwindigkeit wichtiger ist als saubere schnelle Bewegung. Für die meisten Aufgaben sind 6–8 ein guter Einstieg. v4 kann über acht Schritte hinaus überschärfen; mehr ist nicht automatisch besser.
Warum hat mein Vier-Schritt-Video Schlieren?
Große, schnelle Bewegungen sind eine bekannte Schwäche weniger Schritte. Erhöhe zuerst auf sechs oder acht. Müssen es wenige Schritte bleiben, vergleiche die ältere larryvrh ckpt-850 mit v4.
Kann ich H3 Turbo auf dieser Website ausführen?
Nein. Der Generator dieser Website nutzt das normale MiniMax H3, keine Turbo-LoRA. Diese Seite hilft bei der lokalen Einrichtung der Turbo-Checkpoints in ComfyUI oder Diffusers.
Welche Lizenz haben die Turbo-LoRAs?
Die aufgeführten LightX2V/ModelTC- und larryvrh-Checkpoints werden unter Apache-2.0 veröffentlicht. Prüfe vor kommerzieller Nutzung die jeweilige Modellkarte, da Basismodell und LoRA getrennte Bedingungen haben.
Brauche ich einen Custom Node für ComfyUI?
Nein. H3 wird nativ unterstützt und kann den normalen LoRA-Loader nutzen. Speichere die Datei in ComfyUI/models/loras/ und verbinde sie zwischen Modell-Loader und Sampler.
Welche LoRA-Stärke soll ich verwenden?
Die v4-Modellkarte setzt 1.0 an. Aus der Community gibt es Beispiele mit 0.6–0.8 bei 6–10 Schritten; auch Kijai empfiehlt bei Rauschen eine niedrigere Stärke. Starte bei 1.0 und passe schrittweise an.
Funktioniert H3 Turbo mit zwei Schritten?
Nach v4 wurde aus der Community ein Zwei-Schritt-Durchlauf mit sauberem Audio berichtet, allerdings mit deutlich weicherem Video. Das ist kein sinnvoller Standard; plane zunächst mit mindestens vier Schritten.
Welche Variante eignet sich für 12 GB VRAM?
Prüfe verkleinerte oder INT8-Konvertierungen statt vollem bf16. Bleibe bei 544p und aktiviere Offloading und Block Swap. Q4/Q2 existieren ebenfalls, erfordern aber eine gesonderte Prüfung von Audio und Synchronität.
Kann ich SageAttention gleichzeitig nutzen?
Ja. SageAttention beschleunigt die Attention-Berechnung, Turbo reduziert Sampling-Schritte. Beide wirken an unterschiedlichen Stellen. Ein persönlicher RTX-5080-Bericht zeigte Vorteile der Kombination, aber keine allgemeine Leistungsgarantie.