GPT-Live 1
Front-end de voz full-duplex do OpenAI para conversas naturais que delega raciocínios e ações mais profundos a um agente de back-end separado.
Front-end de voz full-duplex do OpenAI para conversas naturais que delega raciocínios e ações mais profundos a um agente de back-end separado.
Visão geral em inglês simples
O GPT-Live 1 ouve e fala ao mesmo tempo, para que possa lidar com pausas, reconhecimentos, interrupções e ruídos de fundo sem forçar cada troca em curvas rígidas. Ele também fornece transcrições e texto de resposta junto com o áudio ao vivo.
A arquitetura separa a conversa do trabalho mais profundo. GPT-Live 1 gerencia a experiência de voz enquanto um modelo de Respostas ou um agente operado por aplicativo lida com o raciocínio e as ferramentas aprovadas. O preço de voz publicado exclui, portanto, o uso do modelo backend, ferramentas, telefonia e infraestrutura de aplicativos.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Acesso à API e ao provedor
Disponibilidade
Disponível por meio da Live API do OpenAI para aplicativos de navegador, servidor e telefonia de voz.
O acesso direto segue a lista de países com suporte ao vivo do OpenAI; o nível de API gratuito não é compatível com este modelo.
Verifique a disponibilidade ao vivoDados e treinamento
OpenAI diz que o conteúdo da API não é usado para treinamento por padrão. Os registros padrão de monitoramento de abuso podem ser retidos por até 30 dias, com controles adicionais disponíveis para organizações qualificadas.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
Front-end de voz full-duplex do OpenAI para conversas naturais que delega raciocínios e ações mais profundos a um agente de back-end separado. O GPT-Live 1 ouve e fala ao mesmo tempo, para que possa lidar com pausas, reconhecimentos, interrupções e ruídos de fundo sem forçar cada troca em curvas rígidas. Ele também fornece transcrições e texto de resposta junto com o áudio ao vivo.
GPT-Live 1 foi lançado em 10 de setembro de 2026 de acordo com os materiais do fornecedor citado.
Disponível por meio da Live API do OpenAI para aplicativos de navegador, servidor e telefonia de voz. As rotas de acesso listadas neste guia são OpenAI.
US$ 0,05 / minuto de voz. As sessões de voz são cobradas por segundo, sem arredondamento de minuto inteiro. O modelo de back-end e o uso da ferramenta são cobrados separadamente, assim como a telefonia e a infraestrutura de aplicativos.
Disponível por meio da Live API do OpenAI para aplicativos de navegador, servidor e telefonia de voz. O acesso direto segue a lista de países com suporte ao vivo do OpenAI; o nível de API gratuito não é compatível com este modelo.
OpenAI diz que o conteúdo da API não é usado para treinamento por padrão. Os registros padrão de monitoramento de abuso podem ser retidos por até 30 dias, com controles adicionais disponíveis para organizações qualificadas. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Comparações relacionadas
Modelo de raciocínio de fala para fala em tempo real do OpenAI para agentes de voz que usam ferramentas e que também precisam de contexto de texto e imagem.
Abrir comparação completaModelo de visualização de áudio para áudio do Google para diálogo de baixa latência com consciência multimodal, pensamento, base de pesquisa e chamada de função.
Abrir comparação completaModelo expressivo de conversão de texto em fala em tempo real do ElevenLabs para diálogo natural, entrega emocional, tags de áudio e mais de 70 idiomas.
Abrir comparação completaO mais novo modelo expressivo de conversão de texto em fala em tempo real da Inworld, projetado para lembrar a conversação e falar em mais de 100 idiomas.
Abrir comparação completaModelo atual de fala em fala em tempo real do SpaceXAI para agentes de conversação em menos de um segundo com acesso a ferramentas.
Abrir comparação completa