Das alte synchronisierte Audio-Video-Modell von OpenAI für kurze text- oder bildgesteuerte Clips – immer noch dokumentiert, aber kurz vor einer dauerhaften API-Abschaltung.
- Generationspreis
- 0,10 $/generierte Sekunde
- Clipdauer
- 4, 8 oder 12 Sekunden
Ressourcen
Zeigt 1–12 der 12-Modelle
Das alte synchronisierte Audio-Video-Modell von OpenAI für kurze text- oder bildgesteuerte Clips – immer noch dokumentiert, aber kurz vor einer dauerhaften API-Abschaltung.
Das Vorschauvideomodell von Google für die text-, bild- und videogeführte Generierung mit nativem Audio und Ausgabeoptionen bis zu 4K.
Google · Vorschau
Die kostengünstigere Veo 3.1-Variante von Google für die schnelle Erstellung kurzer Videoclips mit nativem Audio und Ausgabeoptionen bis zu 4K.
Runway · Stabil
Runways Flaggschiff-Entwickler-Videomodell für text- und bildgesteuerte Clips mit professionellen Formaten und einer vorhersehbaren Basisrate pro Sekunde.
Kuaishou · Stabil
Das über fal bereitgestellte Pro-Videomodell von
Kuaishou · Stabil
Ein kostenbewusstes Kling-Modell auf fal für flüssige fünf- oder zehnsekündige Clips, die aus Text oder einem Startbild generiert werden.
SpaceXAI · Stabil
Das aktuelle Videomodell von SpaceXAI zum Umwandeln von Text, Bildern oder Referenzen in kurze Clips mit optional generierter Sprache und Ton.
ByteDance Seed · Stabil
Das aktuelle audiovisuelle Modell von ByteDance für zusammenhängende Clips mit einer Länge von bis zu 30 Sekunden, mit nativem Ton, langem Storytelling, umfangreichen Referenzen und gezielter Bearbeitung.
HappyHorse · Stabil
Die einheitliche Videofamilie von Alibaba zum Erstellen kurzer Clips mit Ton aus Text, einem Startbild oder einem Referenzvideo.
Lightricks · Stabil
Das qualitätsorientierte Videomodell Lightricks zum Erstellen von 720p- oder 1080p-Clips aus Text, Bildern oder Audio mit nativem Ton.
Lightricks · Stabil
Das geschwindigkeitsoptimierte Videomodell von LTX für Text-, Bild- oder Audioeingabe, nativer Ton, automatische Dauer und Ausgabe bis zu 4K.
Lightricks · Stabil
Das ausgereifte Full-Workflow-Videomodell von LTX für die Generierung plus Retake, Extend, Reframe, natives Audio und Steuerung vom ersten bis zum letzten Bild.
So verwenden Sie diese Bibliothek
Ein kuratierter, kategorieübergreifender Satz grenzüberschreitender, spezialisierter und kategoriedefinierender Modelle mit praktischen API-Informationen für echte Produktentscheidungen.
Cody führt keine universelle Qualitätsbestenliste. Anbieteransprüche sind gekennzeichnet, die Preise verstehen sich ohne Steuern und optionale Tools und Produktionskäufer sollten die Bedingungen des Live-Anbieters prüfen, bevor sie sich für ein Modell entscheiden.
Nutzen Sie, wann immer vorhanden, Erstanbieterdokumentation für technische Grenzen, Lebenszyklus, Preise, regionalen Zugriff und Datenrichtlinien.
Vergleichen Sie Modelle nur innerhalb derselben Kategorie und behalten Sie die Messbasis jedes Anbieters bei.
Nicht veröffentlicht anzeigen, wenn ein Anbieter einen vergleichbaren Sachverhalt nicht veröffentlicht, sondern nicht geschätzt hat.
Behandeln Sie Preise und Verfügbarkeit als veraltete Momentaufnahmen und verknüpfen Sie jede Seite mit der Live-Dokumentation des Anbieters.
Sprachlatenz, Textdurchsatz, Video-Renderzeit und Weltmodell-Bildrate sind nicht austauschbar.
Ein fehlendes Veröffentlichungsdatum, eine fehlende Länderliste oder eine fehlende Latenzzahl wird als „unveröffentlicht“ statt als „geschätzt“ gekennzeichnet.
Modellseiten verweisen auf die zugrunde liegende Quelle und zeigen an, wann Preise, Zugriff und Richtlinien zuletzt überprüft wurden.
Setzen Sie das Modell in die Tat um
Nutzen Sie die erweiterten Prompt-Playbooks und kuratierten Agentenfähigkeiten von Cody, um eine Modellauswahl in einen wiederholbaren Workflow umzuwandeln.