Scribe v2
ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。
ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。
平易な英語による概要
Scribe v2 は、言語検出、単語タイムスタンプ、話者ダイアライゼーション、音声以外のイベントの音声タグを使用して、長い音声またはビデオを構造化されたトランスクリプトに変換します。キータームプロンプトは、チームが一般的な認識モデルが見逃しがちな名前、製品、語彙を保存するのに役立ちます。
ElevenLabs は、ファイル トランスクリプションと別途料金のリアルタイム ルートを提供します。より広範なプラットフォームでは、音声およびエージェント製品も提供されており、単一ベンダーのオーディオ パイプラインを簡素化できますが、各機能には独自の請求およびデータ制御があります。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
録音時間を時間単位で入力します。30分=0.5時間です。追加機能や最低料金で請求額が変わる場合があります。
Scribe v2
ElevenLabs
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
ElevenLabs speech-to-text API および製品インターフェイスを通じて利用できます。 realtime は別のモデル ルートを使用します。
グローバルおよびデータ常駐オプションは、ElevenLabs プラン、エンドポイント、およびエンタープライズ構成によって異なります。
ライブの空き状況を確認するデータとトレーニング
ElevenLabs を使用すると、対象となる API 顧客がデータ使用設定を管理できます。 Enable_logging=false によるゼロデータ保持は、Scribe v2 を含む、対象となるエンタープライズ構成およびサポートされているモデルに限定されます。ライブ プランとリージョン エンドポイントを確認します。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。 Scribe v2 は、言語検出、単語タイムスタンプ、話者ダイアライゼーション、音声以外のイベントの音声タグを使用して、長い音声またはビデオを構造化されたトランスクリプトに変換します。キータームプロンプトは、チームが一般的な認識モデルが見逃しがちな名前、製品、語彙を保存するのに役立ちます。
引用されたプロバイダーの資料によると、Scribe v2 は 2026年1月9日 でリリースされました。
ElevenLabs speech-to-text API および製品インターフェイスを通じて利用できます。 realtime は別のモデル ルートを使用します。 このガイドに記載されているアクセスルートは ElevenLabs、ElevenLabs API です。
Scribe v2 の場合 $0.22 / オーディオ時間. ElevenLabs には、バッチ Scribe v2 と Scribe v2 リアルタイムの個別の価格がリストされています。エンティティの検出と編集は個別に請求できます。
ElevenLabs speech-to-text API および製品インターフェイスを通じて利用できます。 realtime は別のモデル ルートを使用します。 グローバルおよびデータ常駐オプションは、ElevenLabs プラン、エンドポイント、およびエンタープライズ構成によって異なります。
ElevenLabs を使用すると、対象となる API 顧客がデータ使用設定を管理できます。 Enable_logging=false によるゼロデータ保持は、Scribe v2 を含む、対象となるエンタープライズ構成およびサポートされているモデルに限定されます。ライブ プランとリージョン エンドポイントを確認します。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
関連する比較
Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。
完全な比較を開くMicrosoft の高速バッチ文字起こしモデルは、長時間の録音、話者ラベル、単語のタイミング、キーワードのバイアス、クリーンなトランスクリプトまたは逐語的なトランスクリプトに対応します。
完全な比較を開くGoogle Cloud の一般的な音声テキスト変換モデル。多くの言語と地域にわたるストリーミング、ファイル、低コストの動的バッチ文字起こしに使用されます。
完全な比較を開くコードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。
完全な比較を開く