音声認識と文字起こし に戻る

機種比較

Universal-3.5 Pro vs Scribe v2

Compare Universal-3.5 Pro and Scribe v2 using the same provider-sourced 音声認識と文字起こし rubric.謎のスコアや発明されたベンチマークランキングはありません。

事実確認済み 2026年9月4日

コストを見積もる

利用量を入力すると、見積もりが自動で更新されます。

録音時間を時間単位で入力します。30分=0.5時間です。追加機能や最低料金で請求額が変わる場合があります。

見積もりの仕組み

税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。

コストを見積もる
モデル合計見積額(USD)
Scribe v2ElevenLabs確認済み料金なし
Universal-3.5 ProAssemblyAI確認済み料金なし

クイックテイク

Universal-3.5 Pro

コードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。

こんな方に最適

  • 言語切り替えによる会議と通話
  • 専用の音声 API が必要な開発者向け製品
  • コンテキストまたはキーワードのプロンプトから恩恵を受けるワークフロー

気をつけてください

非同期ルートとリアルタイム ルートの価格は異なり、保持期間はエンドポイントとアカウントの制御によって異なります。オプション機能の料金、EU ルーティング、トレーニング オプトアウト、BAA ステータス、およびゼロ保持資格を確認します。

Scribe v2

ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。

こんな方に最適

  • 多言語メディアの文字起こし
  • 多数のスピーカーまたはサウンドイベントによる録音
  • オーディオ スタックはすでに ElevenLabs を使用しています

気をつけてください

バッチとリアルタイムが同じルートまたは価格であると想定しないでください。ゼロデータ保持は自動ではなく条件付きであるため、機密オーディオを処理する前に、プラン、エンドポイント、リージョン、およびenable_loggingの動作を確認してください。

公表された事実を比較する

Universal-3.5 Pro vs Scribe v2

値には、各プロバイダーが独自に公開している単位と制限が使用されます。空白は、プロバイダーがレビューされた情報源で直接比較可能な値を公開していないことを意味します。

音声認識と文字起こしUniversal-3.5 ProScribe v2
転写価格リストされた処理ルートの音声時間または分あたりの現在のプロバイダーの料金。$0.21/時間の非同期 · $0.45/時間のストリーミング$0.22/音声時間。リアルタイムは別途記載
ライブまたはバッチモデルがリアルタイム ストリーム、アップロードされた録画、またはその両方を処理するかどうか。アップロードされたファイルとリアルタイムストリーミングバッチおよび長い音声。別のリアルタイムルート
言語プロバイダーが公開する言語のカバレッジ。必要に応じて、トレーニングまたは宣伝されたカバレッジを、特別に検証された言語から分離します。発売時点で 18 言語に対応し、ネイティブ コード スイッチングを搭載90以上の言語
スピーカーラベルモデルが誰が発言したか、および公開されている発言者の制限を識別するかどうか。はい最大 32 個のスピーカー
タイムスタンプ利用可能な単語、セグメント、または発話レベルのタイミング情報。ワードレベルのタイムスタンプワードレベルのタイムスタンプ
語彙コントロールキーワードブースティング、カスタムスペル、コンテキスト、プロンプト、またはドメイン用語を改善するその他の方法。コンテキストプロンプトとキータームプロンプト最大 1,000 個のキーワード。オーディオタグと言語検出
どこで使用するかプロバイダーによって文書化されたダイレクト API、クラウド カタログ、アプリケーション、または地域のエンドポイント。AssemblyAI 米国および EU APIElevenLabs Speech-to-Text API

選び方

誇大宣伝ではなく、仕事を比較してください。

完了する必要があるジョブから始めて、正確なプロバイダー ルートのコスト、アクセス、ポリシーの詳細を検証します。

Universal-3.5 Pro

AssemblyAI の保持とモデル トレーニングの動作は、エンドポイント、契約、BAA ステータス、EU の処理、およびオプトアウト設定によって異なります。そのドキュメントでは、適格なリアルタイム使用のためのゼロデータ保持オプションについて説明しています。正確なアカウント構成を確認してください。

Scribe v2

ElevenLabs を使用すると、対象となる API 顧客がデータ使用設定を管理できます。 Enable_logging=false によるゼロデータ保持は、Scribe v2 を含む、対象となるエンタープライズ構成およびサポートされているモデルに限定されます。ライブ プランとリージョン エンドポイントを確認します。

よくある質問

Universal-3.5 Pro と Scribe v2 のよくある質問

Universal-3.5 Pro と Scribe v2 の主な違いは何ですか?

Universal-3.5 Pro: コードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。 Scribe v2: ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。

Universal-3.5 Pro または Scribe v2 を選択する必要がありますか?

優先順位が 言語切り替えによる会議と通話 の場合は、Universal-3.5 Pro を検討してください。優先順位が 多言語メディアの文字起こし の場合は、Scribe v2 を検討してください。 Test both with your own data and provider route before committing.

これは Universal-3.5 Pro と Scribe v2 の比較は Cody ベンチマークに基づいていますか?

いいえ。この比較は、プロバイダーが公開した 音声認識と文字起こし カテゴリの事実を一致させます。普遍的な勝者を主張したり、互換性のないサードパーティのベンチマーク スコアを組み合わせたりするものではありません。