Muse Voice Transcribe
Modèle de reconnaissance vocale en streaming de Meta pour les sous-titres en direct, l'audio long, de nombreux haut-parleurs, la commutation de code et la transcription sensible au domaine.
Modèle de reconnaissance vocale en streaming de Meta pour les sous-titres en direct, l'audio long, de nombreux haut-parleurs, la commutation de code et la transcription sensible au domaine.
Présentation de l'anglais simple
Muse Voice Transcribe est conçu pour la parole qui arrive en continu plutôt que uniquement sous forme de téléchargement terminé. Il peut traiter de petits morceaux audio, décider quand un énoncé est terminé, étiqueter de nombreux locuteurs et utiliser des indications de langue, de mots clés et de contexte pour améliorer les noms ou le vocabulaire spécialisé.
Meta propose une large formation multilingue tout en identifiant un ensemble plus restreint de langues spécifiquement vérifiées. Cette distinction est utile pour l'approvisionnement : testez les accents exacts, les modèles de commutation de code, le bruit et le chevauchement des haut-parleurs dans vos propres appels avant de traiter l'ensemble de formation plus large comme une couverture de production.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Tarifs et comparaisons
Indiquez votre utilisation. L’estimation se met à jour à chaque modification.
Utilise la durée en heures : 30 minutes = 0,5 heure. Options et frais minimums peuvent modifier la facture.
Muse Voice Transcribe
Meta
Total estimé (USD)
Pour l’utilisation indiquée · USD · Tarif API, hors abonnement
Les estimations excluent taxes, outils, stockage/écriture du cache, quotas gratuits et remises personnalisées. Pour les images, seule la sortie est incluse, pas le prompt ni les références. Les modes de qualité varient. Un paramètre non répertorié n’est pas gratuit.
Accès API et fournisseur
Disponibilité
Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model.
Meta n'énumère pas une liste de pays ou de région de traitement spécifique au modèle sur la page de lancement publique ; utilisez les conditions actuelles du compte de développeur.
Vérifier la disponibilité en directDonnées et formation
La page de lancement de Meta décrit la confidentialité de sa démo publique, et non un engagement complet de rétention de l'API modèle ou d'utilisation de la formation. Consultez les termes actuels de l’API Model et les contrôles de l’entreprise avant d’envoyer du contenu audio sensible.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
Modèle de reconnaissance vocale en streaming de Meta pour les sous-titres en direct, l'audio long, de nombreux haut-parleurs, la commutation de code et la transcription sensible au domaine. Muse Voice Transcribe est conçu pour la parole qui arrive en continu plutôt que uniquement sous forme de téléchargement terminé. Il peut traiter de petits morceaux audio, décider quand un énoncé est terminé, étiqueter de nombreux locuteurs et utiliser des indications de langue, de mots clés et de contexte pour améliorer les noms ou le vocabulaire spécialisé.
Muse Voice Transcribe a été publié sur 1 septembre 2026 selon les documents du fournisseur cités.
Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model. Les voies d'accès répertoriées dans ce guide sont Meta Model API et Meta.
0,18 $/heure audio. Meta répertorie ce taux d'API de modèle dans le catalogue examiné. Les tolérances de produits dans Meta AI pour Mac ou Muse Code peuvent différer.
Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model. Meta n'énumère pas une liste de pays ou de région de traitement spécifique au modèle sur la page de lancement publique ; utilisez les conditions actuelles du compte de développeur.
La page de lancement de Meta décrit la confidentialité de sa démo publique, et non un engagement complet de rétention de l'API modèle ou d'utilisation de la formation. Consultez les termes actuels de l’API Model et les contrôles de l’entreprise avant d’envoyer du contenu audio sensible. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
Comparaisons associées
Modèle de transcription par lots rapide de Microsoft pour les enregistrements longs, les étiquettes des locuteurs, la synchronisation des mots, la polarisation des mots clés et les transcriptions claires ou textuelles.
Ouvrir la comparaison complèteModèle général de synthèse vocale de Google Cloud pour le streaming, les fichiers et la transcription par lots dynamiques à faible coût dans de nombreuses langues et régions.
Ouvrir la comparaison complèteModèle de transcription axé sur la précision du AssemblyAI pour les fichiers et l'audio en direct, avec commutation de code, étiquettes de locuteur, horodatages et invites contextuelles.
Ouvrir la comparaison complèteModèle de synthèse vocale multilingue de ElevenLabs pour des transcriptions détaillées avec de nombreux locuteurs, une synchronisation des mots, des événements audio et de grandes listes de mots clés personnalisées.
Ouvrir la comparaison complète