Universal-3.5 Pro
El modelo de transcripción centrado en la precisión de AssemblyAI para archivos y audio en vivo, con cambio de código, etiquetas de oradores, marcas de tiempo e indicaciones contextuales.
El modelo de transcripción centrado en la precisión de AssemblyAI para archivos y audio en vivo, con cambio de código, etiquetas de oradores, marcas de tiempo e indicaciones contextuales.
Descripción general en inglés sencillo
Universal-3.5 Pro es un modelo de voz para equipos de productos que desean una API de transcripción enfocada en lugar de un amplio catálogo en la nube. Maneja grabaciones cargadas y transmisiones en tiempo real, admite el cambio de código nativo y puede usar contexto o términos clave para mejorar los nombres de las empresas y el lenguaje especializado.
AssemblyAI separa la transcripción base de las funciones de inteligencia opcionales y ofrece puntos finales de EE. UU. y la UE. Esto hace que la factura y los datos sean configurables, pero también significa que los equipos deben comparar la solicitud completa, no solo la tarifa base por hora anunciada.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Usa la duración en horas: 30 minutos = 0,5 horas. Funciones extra y cargos mínimos pueden cambiar el total.
Universal-3.5 Pro
AssemblyAI
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
Disponible a través de las API de EE. UU. y UE de AssemblyAI para archivos asincrónicos y transmisión en tiempo real.
Los puntos finales de EE. UU. y la UE están documentados; La función y el comportamiento de retención pueden diferir según el terminal y el acuerdo de cuenta.
Consultar disponibilidad en vivoDatos y entrenamiento
El comportamiento de retención y entrenamiento de modelos de AssemblyAI depende del punto final, el contrato, el estado de BAA, el procesamiento en la UE y la configuración de exclusión voluntaria. Sus documentos describen opciones de retención de datos cero para uso elegible en tiempo real; Verifique la configuración exacta de la cuenta.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
El modelo de transcripción centrado en la precisión de AssemblyAI para archivos y audio en vivo, con cambio de código, etiquetas de oradores, marcas de tiempo e indicaciones contextuales. Universal-3.5 Pro es un modelo de voz para equipos de productos que desean una API de transcripción enfocada en lugar de un amplio catálogo en la nube. Maneja grabaciones cargadas y transmisiones en tiempo real, admite el cambio de código nativo y puede usar contexto o términos clave para mejorar los nombres de las empresas y el lenguaje especializado.
Universal-3.5 Pro se lanzó en 7 de julio de 2026 según los materiales del proveedor citados.
Disponible a través de las API de EE. UU. y UE de AssemblyAI para archivos asincrónicos y transmisión en tiempo real. Las rutas de acceso enumeradas en esta guía son AssemblyAI.
$0,21 / hora de audio asíncrono · $0,45 / hora de transmisión. Async y streaming utilizan diferentes rutas y velocidades incluso cuando se selecciona la misma familia de modelos. Las funciones de inteligencia opcionales pueden aumentar los costos.
Disponible a través de las API de EE. UU. y UE de AssemblyAI para archivos asincrónicos y transmisión en tiempo real. Los puntos finales de EE. UU. y la UE están documentados; La función y el comportamiento de retención pueden diferir según el terminal y el acuerdo de cuenta.
El comportamiento de retención y entrenamiento de modelos de AssemblyAI depende del punto final, el contrato, el estado de BAA, el procesamiento en la UE y la configuración de exclusión voluntaria. Sus documentos describen opciones de retención de datos cero para uso elegible en tiempo real; Verifique la configuración exacta de la cuenta. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio.
Abrir comparación completaEl rápido modelo de transcripción por lotes de Microsoft para grabaciones largas, etiquetas de oradores, sincronización de palabras, sesgo de palabras clave y transcripciones limpias o textuales.
Abrir comparación completaEl modelo general de voz a texto de Google Cloud para transmisión, archivos y transcripción por lotes dinámicos de bajo costo en muchos idiomas y regiones.
Abrir comparación completaModelo multilingüe de voz a texto ElevenLabs para transcripciones detalladas con muchos hablantes, sincronización de palabras, eventos de audio y grandes listas de términos clave personalizados.
Abrir comparación completa