Grok Imagine Video 1.5
Obecny model wideo SpaceXAI do przekształcania tekstu, obrazów lub odniesień w krótkie klipy z opcjonalnie generowaną mową i dźwiękiem.
Obecny model wideo SpaceXAI do przekształcania tekstu, obrazów lub odniesień w krótkie klipy z opcjonalnie generowaną mową i dźwiękiem.
Przegląd w prostym języku angielskim
Grok Imagine Video 1.5 tworzy klipy o długości od jednej do piętnastu sekund i może nagrywać wideo w rozdzielczości do 1080p. Obsługuje zamianę tekstu na wideo, animację obrazu, generowanie, edycję i gotowe głosy w oparciu o odniesienia, co czyni go szerokim multimedialnym punktem końcowym dla zespołów już korzystających z interfejsu API Grok.
Żądania działają asynchronicznie, a cena rośnie wraz z rozdzielczością danych wyjściowych. Model może generować dźwięk z wideo lub zwracać cichy klip, gdy dźwięk nie jest potrzebny.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Przykład: 8-sekundowe klipy 720p z dźwiękiem. Modele nieobsługujące tych ustawień nie otrzymają szacunku.
Grok Imagine Video 1.5
SpaceXAI
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Ogólnie dostępne za pośrednictwem interfejsu API SpaceXAI Imagine z obsługą wsadową.
Strona modelu zawiera listę us-east-1 i us-west-2. Wyjściowe adresy URL są tymczasowe i należy je natychmiast zapisać.
Sprawdź dostępność na żywoDane i szkolenia
SpaceXAI mówi, że wejścia i wyjścia API nie są używane do szkolenia bez wyraźnej zgody. Domyślne zaszyfrowane przechowywanie wynosi 30 dni; Zerowe przechowywanie danych na poziomie zespołu jest dostępne z kompromisami w zakresie funkcji.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Obecny model wideo SpaceXAI do przekształcania tekstu, obrazów lub odniesień w krótkie klipy z opcjonalnie generowaną mową i dźwiękiem. Grok Imagine Video 1.5 tworzy klipy o długości od jednej do piętnastu sekund i może nagrywać wideo w rozdzielczości do 1080p. Obsługuje zamianę tekstu na wideo, animację obrazu, generowanie, edycję i gotowe głosy w oparciu o odniesienia, co czyni go szerokim multimedialnym punktem końcowym dla zespołów już korzystających z interfejsu API Grok.
Według materiałów cytowanego dostawcy Grok Imagine Video 1.5 został wydany na 16 czerwca 2026.
Ogólnie dostępne za pośrednictwem interfejsu API SpaceXAI Imagine z obsługą wsadową. Drogi dostępu wymienione w tym przewodniku to SpaceXAI.
0,08–0,25 USD / wygenerowana sekunda. SpaceXAI podaje 0,08 USD/s przy 480p, 0,14 USD/s przy 720p i 0,25 USD/s przy 1080p. Obraz wejściowy dodaje 0,01 USD; Wstępnie ustawione głosowe wejście audio jest bezpłatne.
Ogólnie dostępne za pośrednictwem interfejsu API SpaceXAI Imagine z obsługą wsadową. Strona modelu zawiera listę us-east-1 i us-west-2. Wyjściowe adresy URL są tymczasowe i należy je natychmiast zapisać.
SpaceXAI mówi, że wejścia i wyjścia API nie są używane do szkolenia bez wyraźnej zgody. Domyślne zaszyfrowane przechowywanie wynosi 30 dni; Zerowe przechowywanie danych na poziomie zespołu jest dostępne z kompromisami w zakresie funkcji. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
Powiązane porównania
Starszy model wideo z zsynchronizowanym dźwiękiem OpenAI dla krótkich klipów z przewodnikiem tekstowym lub obrazowym — nadal udokumentowany, ale zbliża się trwałe zamknięcie interfejsu API.
Otwórz pełne porównaniePodgląd modelu wideo Google do generowania tekstu, obrazu i wideo z natywnym dźwiękiem i opcjami wyjściowymi do 4K.
Otwórz pełne porównanieTańszy wariant Veo 3.1 Google do szybkiego tworzenia krótkich klipów wideo z natywnym dźwiękiem i opcjami wyjściowymi do 4K.
Otwórz pełne porównanieFlagowy model wideo dla programistów Runway do klipów z przewodnikiem tekstowym i obrazowym, w profesjonalnych formatach i przewidywalnej podstawowej stawce kredytu na sekundę.
Otwórz pełne porównaniePro model wideo Kuaishou dostarczany za pośrednictwem fal do generowania wielu zdjęć tekstu/obrazu, opcjonalnego natywnego dźwięku, referencji i klipów trwających do 15 sekund.
Otwórz pełne porównanieEkonomiczny model Klinga na fal do płynnych, pięcio- lub dziesięciosekundowych klipów generowanych z tekstu lub obrazu początkowego.
Otwórz pełne porównanieObecny model audiowizualny ByteDance dla spójnych klipów trwających do 30 sekund, z natywnym dźwiękiem, długą historią, bogatymi odniesieniami i ukierunkowaną edycją.
Otwórz pełne porównanieUjednolicona rodzina wideo Alibaba do tworzenia krótkich klipów z dźwiękiem z tekstu, obrazu początkowego lub wideo referencyjnego.
Otwórz pełne porównanieModel wideo Lightricks zorientowany na jakość do tworzenia klipów w rozdzielczości 720p lub 1080p z tekstu, obrazów lub dźwięku z natywnym dźwiękiem.
Otwórz pełne porównanieModel wideo LTX zoptymalizowany pod kątem szybkości dla tekstu, obrazu lub sygnału wejściowego, dźwięku natywnego, automatycznego czasu trwania i sygnału wyjściowego do 4K.
Otwórz pełne porównanieDojrzały, kompletny model wideo LTX do generacji, plus ponowne pobieranie, rozszerzanie, ponowne kadrowanie, natywny dźwięk i kontrola od pierwszej do ostatniej klatki.
Otwórz pełne porównanie