全モデル
Meta

Muse Voice Transcribe

Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。

平易な英語による概要

Muse Voice Transcribe とは実際には何ですか

Muse Voice Transcribe は、アップロード完了としてではなく、継続的に受信される音声向けに設計されています。小さな音声の塊を処理し、発話がいつ終了したかを判断し、多くの話者にラベルを付け、言語、キーワード、文脈のヒントを使用して名前や専門用語を改善できます。

Meta は、具体的に検証された少数の言語セットを特定しながら、広範な多言語トレーニングを宣伝しています。この区別は調達に役立ちます。より広範なトレーニング セットを本番カバレッジとして扱う前に、自分の通話で正確なアクセント、コード スイッチング パターン、ノイズ、話者の重複をテストします。

ぴったりフィット

  • ライブキャプションと会話型インターフェース
  • 複数の講演者による会議と長時間の録音
  • キーワードまたはコンテキストのバイアスが必要な商品

カテゴリ比較

転写 モデルにとって重要な事実

これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。

転写価格
$0.18 / 音声時間リストされた処理ルートの音声時間または分あたりの現在のプロバイダーの料金。
ライブまたはバッチ
リアルタイムストリーミングと長編オーディオモデルがリアルタイム ストリーム、アップロードされた録画、またはその両方を処理するかどうか。
言語
70 以上の言語についてトレーニングを受けています。 25具体的に検証済みプロバイダーが公開する言語のカバレッジ。必要に応じて、トレーニングまたは宣伝されたカバレッジを、特別に検証された言語から分離します。
スピーカーラベル
はい。 20名以上の講演者が宣伝されていますモデルが誰が発言したか、および公開されている発言者の制限を識別するかどうか。
タイムスタンプ
ストリーミングトランスクリプトのタイミングとエンドポイント利用可能な単語、セグメント、または発話レベルのタイミング情報。
語彙コントロール
言語、キーワード、およびコンテキストのバイアス。コードスイッチングキーワードブースティング、カスタムスペル、コンテキスト、プロンプト、またはドメイン用語を改善するその他の方法。
どこで使用するか
Meta Model API、Meta AI for Mac、Muse コードプロバイダーによって文書化されたダイレクト API、クラウド カタログ、アプリケーション、または地域のエンドポイント。

料金と比較

コストを見積もる

利用量を入力すると、見積もりが自動で更新されます。

録音時間を時間単位で入力します。30分=0.5時間です。追加機能や最低料金で請求額が変わる場合があります。

Muse Voice Transcribe

Meta

合計見積額(USD)

確認済み料金なし

上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)

見積もりの仕組み

税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。

APIとプロバイダーへのアクセス

Muse Voice Transcribeの入手場所

可用性

地域とアクセス段階

Model API パブリック プレビュー中に、Meta Model API、Meta AI for Mac、および Muse Code を通じて利用できます。

Meta には、公開開始ページにモデル固有の国または処理地域のリストが 1 つも列挙されていません。現在の開発者アカウントの規約を使用してください。

ライブの空き状況を確認する

データとトレーニング

ルートは重要です。

Meta の開始ページでは、完全なモデル API の保持やトレーニング使用の約束ではなく、公開デモのプライバシーについて説明しています。機密音声を送信する前に、現在の Model API 規約とエンタープライズ コントロールを確認してください。

これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。

プロバイダーポリシーを読む

よくある質問

Muse Voice Transcribe よくある質問

Muse Voice Transcribeとは何ですか?

Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。 Muse Voice Transcribe は、アップロード完了としてではなく、継続的に受信される音声向けに設計されています。小さな音声の塊を処理し、発話がいつ終了したかを判断し、多くの話者にラベルを付け、言語、キーワード、文脈のヒントを使用して名前や専門用語を改善できます。

Muse Voice Transcribe はいつリリースされましたか?

引用されたプロバイダーの資料によると、Muse Voice Transcribe は 2026年9月1日 でリリースされました。

Muse Voice Transcribe にはどこからアクセスできますか?

Model API パブリック プレビュー中に、Meta Model API、Meta AI for Mac、および Muse Code を通じて利用できます。 このガイドに記載されているアクセスルートは Meta Model API、Meta です。

Muse Voice Transcribeの価格はいくらですか?

$0.18 / 音声時間. Meta は、レビューされたカタログにこのモデル API レートをリストします。 Meta AI for Mac または Muse Code の製品許容量は異なる場合があります。

Muse Voice Transcribe はどこで入手できますか?

Model API パブリック プレビュー中に、Meta Model API、Meta AI for Mac、および Muse Code を通じて利用できます。 Meta には、公開開始ページにモデル固有の国または処理地域のリストが 1 つも列挙されていません。現在の開発者アカウントの規約を使用してください。

私の Muse Voice Transcribe API データはトレーニングに使用されますか?

Meta の開始ページでは、完全なモデル API の保持やトレーニング使用の約束ではなく、公開デモのプライバシーについて説明しています。機密音声を送信する前に、現在の Model API 規約とエンタープライズ コントロールを確認してください。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。