Alle Modelle
Meta

Muse Voice Transcribe

Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription.

Übersicht in einfacher englischer Sprache

Was Muse Voice Transcribe eigentlich ist

Muse Voice Transcribe ist für Sprache konzipiert, die kontinuierlich und nicht nur als fertiger Upload eintrifft. Es kann kleine Audioblöcke verarbeiten, entscheiden, wann eine Äußerung beendet ist, viele Sprecher kennzeichnen und Sprach-, Schlüsselwort- und Kontexthinweise verwenden, um Namen oder Fachvokabular zu verbessern.

Meta wirbt für eine umfassende mehrsprachige Schulung und identifiziert gleichzeitig eine kleinere Gruppe speziell verifizierter Sprachen. Diese Unterscheidung ist für die Beschaffung nützlich: Testen Sie die genauen Akzente, Codewechselmuster, Geräusche und Sprecherüberschneidungen in Ihren eigenen Anrufen, bevor Sie den breiteren Trainingssatz als Produktionsabdeckung behandeln.

Gute Passform für

  • Live-Untertitel und Konversationsschnittstellen
  • Meetings mit mehreren Rednern und lange Aufzeichnungen
  • Produkte, die Keyword- oder Kontext-Biasing benötigen

Kategorievergleich

Die Fakten, die für die transkription-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Transkriptionspreis
0,18 $/AudiostundeAktueller Anbieterpreis pro Audiostunde oder Minute für den aufgeführten Verarbeitungsweg.
Live oder Batch
Echtzeit-Streaming und Langform-AudioOb das Modell Echtzeit-Streams, hochgeladene Aufzeichnungen oder beides verarbeitet.
Sprachen
Ausgebildet in über 70 Sprachen; 25 speziell überprüftVom Anbieter veröffentlichte Sprachabdeckung, die bei Bedarf geschulte oder beworbene Abdeckung von speziell verifizierten Sprachen trennt.
Lautsprecheretiketten
Ja; mehr als 20 Referenten ausgeschriebenOb das Modell identifiziert, wer gesprochen hat, und ob ein veröffentlichtes Sprecherlimit vorliegt.
Zeitstempel
Timing und Endpunktierung des Streaming-TranskriptsVerfügbare Timing-Informationen auf Wort-, Segment- oder Äußerungsebene.
Vokabelkontrolle
Sprach-, Schlüsselwort- und Kontext-Biasing; Code-UmschaltungKeyword-Boosting, benutzerdefinierte Rechtschreibung, Kontext, Eingabeaufforderungen oder andere Möglichkeiten zur Verbesserung von Domain-Begriffen.
Wo kann man es verwenden?
Meta Model API, Meta AI für Mac, Muse CodeDirekte API, Cloud-Katalog, Anwendung oder regionaler Endpunkt, dokumentiert vom Anbieter.

Preise und Vergleiche

Kosten schätzen

Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.

Nutzt die Aufnahmedauer in Stunden: 30 Minuten = 0,5 Stunden. Zusatzfunktionen und Mindestgebühren können die Rechnung ändern.

Muse Voice Transcribe

Meta

Geschätzte Summe (USD)

Kein geprüfter Preis

Für die angegebene Nutzung · USD · API-Preis, kein Abonnement

So funktioniert die Schätzung

Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.

API- und Provider-Zugriff

Wo bekomme ich Muse Voice Transcribe?

Verfügbarkeit

Regionen und Zugriffsphase

Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API.

Meta listet auf der öffentlichen Startseite keine modellspezifische Länder- oder Verarbeitungsregionenliste auf. Verwenden Sie die aktuellen Bedingungen für Entwicklerkonten.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Auf der Startseite von Meta wird der Datenschutz für seine öffentliche Demo beschrieben, nicht eine vollständige Aufbewahrung der Modell-API oder eine Verpflichtung zur Schulungsnutzung. Lesen Sie die aktuellen Model-API-Bedingungen und Unternehmenskontrollen, bevor Sie vertrauliche Audiodaten senden.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

Muse Voice Transcribe FAQ

Was ist Muse Voice Transcribe?

Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription. Muse Voice Transcribe ist für Sprache konzipiert, die kontinuierlich und nicht nur als fertiger Upload eintrifft. Es kann kleine Audioblöcke verarbeiten, entscheiden, wann eine Äußerung beendet ist, viele Sprecher kennzeichnen und Sprach-, Schlüsselwort- und Kontexthinweise verwenden, um Namen oder Fachvokabular zu verbessern.

Wann wurde Muse Voice Transcribe veröffentlicht?

Muse Voice Transcribe wurde gemäß den zitierten Anbietermaterialien auf 1. September 2026 veröffentlicht.

Wo kann ich auf Muse Voice Transcribe zugreifen?

Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Meta Model API und Meta.

Wie viel kostet Muse Voice Transcribe?

0,18 $/Audiostunde. Meta listet diese Modell-API-Rate im überprüften Katalog auf. Die Produktkontingente in Meta AI für Mac oder Muse Code können unterschiedlich sein.

Wo ist Muse Voice Transcribe erhältlich?

Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API. Meta listet auf der öffentlichen Startseite keine modellspezifische Länder- oder Verarbeitungsregionenliste auf. Verwenden Sie die aktuellen Bedingungen für Entwicklerkonten.

Werden meine Muse Voice Transcribe-API-Daten für das Training verwendet?

Auf der Startseite von Meta wird der Datenschutz für seine öffentliche Demo beschrieben, nicht eine vollständige Aufbewahrung der Modell-API oder eine Verpflichtung zur Schulungsnutzung. Lesen Sie die aktuellen Model-API-Bedingungen und Unternehmenskontrollen, bevor Sie vertrauliche Audiodaten senden. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.