Scribe v2
Modelo multilingüe de voz a texto ElevenLabs para transcripciones detalladas con muchos hablantes, sincronización de palabras, eventos de audio y grandes listas de términos clave personalizados.
Modelo multilingüe de voz a texto ElevenLabs para transcripciones detalladas con muchos hablantes, sincronización de palabras, eventos de audio y grandes listas de términos clave personalizados.
Descripción general en inglés sencillo
Scribe v2 convierte audio o vídeo de larga duración en transcripciones estructuradas con detección de idioma, marcas de tiempo de palabras, diario del hablante y etiquetas de audio para eventos más allá del habla. Las indicaciones de términos clave ayudan a los equipos a preservar nombres, productos y vocabulario que los modelos de reconocimiento general a menudo pasan por alto.
ElevenLabs ofrece transcripción de archivos y una ruta en tiempo real con precio independiente. La plataforma más amplia también ofrece productos de voz y agentes, que pueden simplificar los procesos de audio de un solo proveedor, aunque cada capacidad tiene sus propios controles de facturación y datos.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Usa la duración en horas: 30 minutos = 0,5 horas. Funciones extra y cargos mínimos pueden cambiar el total.
Scribe v2
ElevenLabs
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
Disponible a través de la API de voz a texto ElevenLabs y las interfaces del producto; en tiempo real utiliza una ruta modelo separada.
Las opciones globales y de residencia de datos dependen del plan ElevenLabs, del terminal y de la configuración empresarial.
Consultar disponibilidad en vivoDatos y entrenamiento
ElevenLabs permite a los clientes de API elegibles administrar las preferencias de uso de datos. La retención de datos cero a través de enable_logging=false se limita a las configuraciones empresariales calificadas y los modelos compatibles, incluido Scribe v2; Verifique el plan en vivo y el punto final regional.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
Modelo multilingüe de voz a texto ElevenLabs para transcripciones detalladas con muchos hablantes, sincronización de palabras, eventos de audio y grandes listas de términos clave personalizados. Scribe v2 convierte audio o vídeo de larga duración en transcripciones estructuradas con detección de idioma, marcas de tiempo de palabras, diario del hablante y etiquetas de audio para eventos más allá del habla. Las indicaciones de términos clave ayudan a los equipos a preservar nombres, productos y vocabulario que los modelos de reconocimiento general a menudo pasan por alto.
Scribe v2 se lanzó en 9 de enero de 2026 según los materiales del proveedor citados.
Disponible a través de la API de voz a texto ElevenLabs y las interfaces del producto; en tiempo real utiliza una ruta modelo separada. Las rutas de acceso enumeradas en esta guía son ElevenLabs y ElevenLabs API.
$0.22 / hora de audio para Scribe v2. ElevenLabs enumera precios separados para el lote Scribe v2 y Scribe v2 Realtime. La detección y redacción de entidades se pueden facturar por separado.
Disponible a través de la API de voz a texto ElevenLabs y las interfaces del producto; en tiempo real utiliza una ruta modelo separada. Las opciones globales y de residencia de datos dependen del plan ElevenLabs, del terminal y de la configuración empresarial.
ElevenLabs permite a los clientes de API elegibles administrar las preferencias de uso de datos. La retención de datos cero a través de enable_logging=false se limita a las configuraciones empresariales calificadas y los modelos compatibles, incluido Scribe v2; Verifique el plan en vivo y el punto final regional. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio.
Abrir comparación completaEl rápido modelo de transcripción por lotes de Microsoft para grabaciones largas, etiquetas de oradores, sincronización de palabras, sesgo de palabras clave y transcripciones limpias o textuales.
Abrir comparación completaEl modelo general de voz a texto de Google Cloud para transmisión, archivos y transcripción por lotes dinámicos de bajo costo en muchos idiomas y regiones.
Abrir comparación completaEl modelo de transcripción centrado en la precisión de AssemblyAI para archivos y audio en vivo, con cambio de código, etiquetas de oradores, marcas de tiempo e indicaciones contextuales.
Abrir comparación completa