Todos os modelos
Meta

Muse Voice Transcribe

Modelo de reconhecimento de fala de streaming do Meta para legendas ao vivo, áudio longo, muitos alto-falantes, troca de código e transcrição com reconhecimento de domínio.

Visão geral em inglês simples

O que Muse Voice Transcribe realmente é

O Muse Voice Transcribe foi projetado para fala que chega continuamente, e não apenas como um upload finalizado. Ele pode processar pequenos pedaços de áudio, decidir quando uma expressão termina, rotular muitos falantes e usar linguagem, palavras-chave e dicas de contexto para melhorar nomes ou vocabulário especializado.

Meta anuncia amplo treinamento multilíngue, ao mesmo tempo que identifica um conjunto menor de idiomas especificamente verificados. Essa distinção é útil para compras: teste os sotaques exatos, os padrões de troca de código, o ruído e a sobreposição de alto-falantes em suas próprias chamadas antes de tratar o conjunto mais amplo de treinamento como cobertura de produção.

Bom ajuste para

  • Legendas ao vivo e interfaces de conversação
  • Reuniões com vários palestrantes e gravações longas
  • Produtos que precisam de polarização de palavras-chave ou contexto

Comparação de categorias

Os fatos que importam para os modelos transcrição

Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.

Preço da transcrição
US$ 0,18/hora de áudioPreço atual do provedor por hora ou minuto de áudio para a rota de processamento listada.
Ao vivo ou em lote
Streaming em tempo real e áudio de formato longoSe o modelo lida com streams em tempo real, gravações carregadas ou ambos.
Idiomas
Treinado em mais de 70 idiomas; 25 verificados especificamenteCobertura de idiomas publicada pelo provedor, separando a cobertura treinada ou anunciada de idiomas especificamente verificados quando necessário.
Etiquetas de alto-falante
Sim; mais de 20 palestrantes anunciadosSe o modelo identifica quem falou e qualquer limite de oradores publicado.
Carimbos de data e hora
Tempo e endpoint da transcrição de streamingInformações disponíveis sobre temporização em nível de palavra, segmento ou enunciado.
Controle de vocabulário
Polarização de idioma, palavra-chave e contexto; troca de códigoAumento de palavras-chave, ortografia personalizada, contexto, solicitações ou outras formas de melhorar os termos do domínio.
Onde usar
Meta Model API, Meta AI para Mac, código MuseAPI direta, catálogo de nuvem, aplicativo ou endpoint regional documentado pelo provedor.

Preços e comparações

Estime seu custo

Defina seu uso. A estimativa é atualizada enquanto você digita.

Usa a duração em horas: 30 minutos = 0,5 hora. Recursos extras e cobranças mínimas podem alterar o total.

Muse Voice Transcribe

Meta

Total estimado (USD)

Sem preço revisado

Para o uso indicado · USD · Preço de API, não de assinatura

Como funciona esta estimativa

Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.

Acesso à API e ao provedor

Onde obter Muse Voice Transcribe

Disponibilidade

Regiões e estágio de acesso

Disponível por meio de Meta Model API, Meta AI para Mac e Muse Code durante a visualização pública da Model API.

Meta não enumera uma lista de países ou regiões de processamento específicas do modelo na página de lançamento pública; use os termos atuais da conta do desenvolvedor.

Verifique a disponibilidade ao vivo

Dados e treinamento

A rota é importante.

A página de lançamento do Meta descreve a privacidade para sua demonstração pública, não uma retenção completa da API do modelo ou compromisso de uso de treinamento. Revise os termos atuais da Model API e os controles corporativos antes de enviar áudio confidencial.

Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.

Leia a política do provedor

Perguntas frequentes

Perguntas frequentes sobre Muse Voice Transcribe

O que é Muse Voice Transcribe?

Modelo de reconhecimento de fala de streaming do Meta para legendas ao vivo, áudio longo, muitos alto-falantes, troca de código e transcrição com reconhecimento de domínio. O Muse Voice Transcribe foi projetado para fala que chega continuamente, e não apenas como um upload finalizado. Ele pode processar pequenos pedaços de áudio, decidir quando uma expressão termina, rotular muitos falantes e usar linguagem, palavras-chave e dicas de contexto para melhorar nomes ou vocabulário especializado.

Quando o Muse Voice Transcribe foi lançado?

Muse Voice Transcribe foi lançado em 1 de setembro de 2026 de acordo com os materiais do fornecedor citado.

Onde posso acessar Muse Voice Transcribe?

Disponível por meio de Meta Model API, Meta AI para Mac e Muse Code durante a visualização pública da Model API. As rotas de acesso listadas neste guia são Meta Model API e Meta.

Quanto custa Muse Voice Transcribe?

US$ 0,18/hora de áudio. Meta lista esta taxa de API de modelo no catálogo revisado. As franquias de produtos no Meta AI para Mac ou no Muse Code podem ser diferentes.

Onde o Muse Voice Transcribe está disponível?

Disponível por meio de Meta Model API, Meta AI para Mac e Muse Code durante a visualização pública da Model API. Meta não enumera uma lista de países ou regiões de processamento específicas do modelo na página de lançamento pública; use os termos atuais da conta do desenvolvedor.

Os dados da minha API Muse Voice Transcribe são usados ​​para treinamento?

A página de lançamento do Meta descreve a privacidade para sua demonstração pública, não uma retenção completa da API do modelo ou compromisso de uso de treinamento. Revise os termos atuais da Model API e os controles corporativos antes de enviar áudio confidencial. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.