Muse Voice Transcribe
Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio.
Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio.
Descripción general en inglés sencillo
Muse Voice Transcribe está diseñado para voz que llega continuamente y no solo como una carga finalizada. Puede procesar pequeños fragmentos de audio, decidir cuándo ha terminado una expresión, etiquetar a muchos hablantes y utilizar sugerencias de lenguaje, palabras clave y contexto para mejorar los nombres o el vocabulario especializado.
Meta anuncia una amplia formación multilingüe al tiempo que identifica un conjunto más pequeño de idiomas específicamente verificados. Esa distinción es útil para las adquisiciones: pruebe los acentos exactos, los patrones de cambio de código, el ruido y la superposición de los hablantes en sus propias llamadas antes de tratar el conjunto de capacitación más amplio como cobertura de producción.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Usa la duración en horas: 30 minutos = 0,5 horas. Funciones extra y cargos mínimos pueden cambiar el total.
Muse Voice Transcribe
Meta
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API.
Meta no enumera una lista de países o regiones de procesamiento específicos del modelo en la página de lanzamiento pública; Utilice los términos actuales de la cuenta de desarrollador.
Consultar disponibilidad en vivoDatos y entrenamiento
La página de lanzamiento de Meta describe la privacidad de su demostración pública, no una retención completa de la API del modelo ni un compromiso de uso de capacitación. Revise los términos actuales de Model API y los controles empresariales antes de enviar audio confidencial.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio. Muse Voice Transcribe está diseñado para voz que llega continuamente y no solo como una carga finalizada. Puede procesar pequeños fragmentos de audio, decidir cuándo ha terminado una expresión, etiquetar a muchos hablantes y utilizar sugerencias de lenguaje, palabras clave y contexto para mejorar los nombres o el vocabulario especializado.
Muse Voice Transcribe se lanzó en 1 de septiembre de 2026 según los materiales del proveedor citados.
Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API. Las rutas de acceso enumeradas en esta guía son Meta Model API y Meta.
$0.18 / hora de audio. Meta enumera esta tarifa de API de modelo en el catálogo revisado. Las asignaciones de productos en Meta AI para Mac o Muse Code pueden diferir.
Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API. Meta no enumera una lista de países o regiones de procesamiento específicos del modelo en la página de lanzamiento pública; Utilice los términos actuales de la cuenta de desarrollador.
La página de lanzamiento de Meta describe la privacidad de su demostración pública, no una retención completa de la API del modelo ni un compromiso de uso de capacitación. Revise los términos actuales de Model API y los controles empresariales antes de enviar audio confidencial. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
El rápido modelo de transcripción por lotes de Microsoft para grabaciones largas, etiquetas de oradores, sincronización de palabras, sesgo de palabras clave y transcripciones limpias o textuales.
Abrir comparación completaEl modelo general de voz a texto de Google Cloud para transmisión, archivos y transcripción por lotes dinámicos de bajo costo en muchos idiomas y regiones.
Abrir comparación completaEl modelo de transcripción centrado en la precisión de AssemblyAI para archivos y audio en vivo, con cambio de código, etiquetas de oradores, marcas de tiempo e indicaciones contextuales.
Abrir comparación completaModelo multilingüe de voz a texto ElevenLabs para transcripciones detalladas con muchos hablantes, sincronización de palabras, eventos de audio y grandes listas de términos clave personalizados.
Abrir comparación completa