Grok Imagine Video 1.5
Modelo de vídeo atual do SpaceXAI para transformar texto, imagens ou referências em clipes curtos com fala e som gerados opcionais.
Modelo de vídeo atual do SpaceXAI para transformar texto, imagens ou referências em clipes curtos com fala e som gerados opcionais.
Visão geral em inglês simples
Grok Imagine Video 1.5 cria clipes de um a quinze segundos de duração e pode produzir vídeo em até 1080p. Ele suporta texto para vídeo, animação de imagem, geração baseada em referência, edição e vozes predefinidas, tornando-o um endpoint de mídia amplo para equipes que já usam a API Grok.
As solicitações são executadas de forma assíncrona e os preços aumentam com a resolução da saída. O modelo pode gerar som com o vídeo ou retornar um clipe silencioso quando o áudio não for necessário.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Exemplo: clipes de 8 segundos em 720p com áudio. Modelos incompatíveis com essas configurações não recebem estimativa.
Grok Imagine Video 1.5
SpaceXAI
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Geralmente disponível por meio da API SpaceXAI Imagine com suporte em lote.
A página do modelo lista us-east-1 e us-west-2. Os URLs de saída são temporários e devem ser salvos imediatamente.
Verifique a disponibilidade ao vivoDados e treinamento
SpaceXAI diz que as entradas e saídas da API não são usadas para treinamento sem permissão explícita. A retenção criptografada padrão é de 30 dias; a retenção zero de dados no nível da equipe está disponível com compensações de recursos.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
Modelo de vídeo atual do SpaceXAI para transformar texto, imagens ou referências em clipes curtos com fala e som gerados opcionais. Grok Imagine Video 1.5 cria clipes de um a quinze segundos de duração e pode produzir vídeo em até 1080p. Ele suporta texto para vídeo, animação de imagem, geração baseada em referência, edição e vozes predefinidas, tornando-o um endpoint de mídia amplo para equipes que já usam a API Grok.
Grok Imagine Video 1.5 foi lançado em 16 de junho de 2026 de acordo com os materiais do fornecedor citado.
Geralmente disponível por meio da API SpaceXAI Imagine com suporte em lote. As rotas de acesso listadas neste guia são SpaceXAI.
US$ 0,08–US$ 0,25 / segundo gerado. SpaceXAI lista US$ 0,08/s a 480p, US$ 0,14/s a 720p e US$ 0,25/s a 1080p. Uma imagem de entrada adiciona US$ 0,01; a entrada de áudio de voz predefinida é gratuita.
Geralmente disponível por meio da API SpaceXAI Imagine com suporte em lote. A página do modelo lista us-east-1 e us-west-2. Os URLs de saída são temporários e devem ser salvos imediatamente.
SpaceXAI diz que as entradas e saídas da API não são usadas para treinamento sem permissão explícita. A retenção criptografada padrão é de 30 dias; a retenção zero de dados no nível da equipe está disponível com compensações de recursos. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Comparações relacionadas
Modelo legado de áudio e vídeo sincronizado do OpenAI para clipes curtos guiados por texto ou imagem - ainda documentado, mas próximo de um desligamento permanente da API.
Abrir comparação completaModelo de vídeo de visualização do Google para geração guiada por texto, imagem e vídeo com áudio nativo e opções de saída de até 4K.
Abrir comparação completaVariante Veo 3.1 de baixo custo do Google para criar rapidamente clipes de vídeo curtos com áudio nativo e opções de saída de até 4K.
Abrir comparação completaO principal modelo de vídeo de desenvolvedor do Runway para clipes guiados por texto e imagem, com formatos profissionais e uma taxa básica de crédito por segundo previsível.
Abrir comparação completaModelo de vídeo Pro do Kuaishou fornecido por meio do fal para geração de texto/imagem multi-shot, áudio nativo opcional, referências e clipes de até 15 segundos.
Abrir comparação completaUm modelo Kling econômico no fal para clipes fluidos de cinco ou dez segundos gerados a partir de texto ou imagem inicial.
Abrir comparação completaO modelo audiovisual atual da ByteDance para clipes coerentes de até 30 segundos, com som nativo, narrativa longa, referências ricas e edição direcionada.
Abrir comparação completaFamília de vídeo unificada do Alibaba para criar clipes curtos com som de texto, uma imagem inicial ou um vídeo de referência.
Abrir comparação completaModelo de vídeo com foco na qualidade Lightricks para criar clipes de 720p ou 1080p a partir de texto, imagens ou áudio com som nativo.
Abrir comparação completaModelo de vídeo com velocidade otimizada do LTX para entrada de texto, imagem ou áudio, som nativo, duração automática e saída de até 4K.
Abrir comparação completaModelo de vídeo de fluxo de trabalho completo maduro do LTX para geração, além de Retake, Extend, Reframe, áudio nativo e controle do primeiro ao último quadro.
Abrir comparação completa