全モデル
本文と推論安定した
NVIDIA

NVIDIA Nemotron 3 Ultra

複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。

平易な英語による概要

NVIDIA Nemotron 3 Ultra とは実際には何ですか

Nemotron 3 Ultra は、各トークンに対して 5500 億のパラメーターを有効にする、5,500 億のパラメーターの専門家混合モデルです。これは、要求の厳しいエージェントおよび推論作業向けに構築されており、構成可能な推論バジェットで最大 100 万トークンのテキスト コンテキストをサポートします。

NVIDIA は、プロトタイプ API、NIM 導入、パートナー エンドポイント、およびダウンロード可能な重みを提供します。この範囲により、チームは利便性を犠牲にしてインフラストラクチャ制御を行うことができますが、パフォーマンスとコストがチェックポイント単独ではなく、選択したデプロイメントの特性であることも意味します。

ぴったりフィット

  • 複雑で長時間実行されるエージェント
  • ラージコンテキスト推論と RAG
  • NVIDIA インフラストラクチャに導入している組織

カテゴリ比較

テキスト モデルにとって重要な事実

これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。

コンテキストウィンドウ
最大100万トークンプロバイダーによって文書化されたプロンプトと作業コンテキストを組み合わせた最大数。
最大出力
個別に公開されていないプロバイダーが公開している応答制限(利用可能な場合)。
知識の遮断
2025 年 9 月までの事前トレーニング。トレーニング後から 2026 年 5 月までモデルプロバイダーによって明示的に公開された、信頼できる最新の知識の日付。検索ツールと接続ツールは新しい情報を取得できますが、モデルの組み込みカットオフは変更しません。
入力価格
無料のプロトタイプまたは導入コストCurrent standard list price per million input tokens unless noted.
出力価格
無料のプロトタイプまたは導入コストCurrent standard list price per million output tokens unless noted.
入力
テキストリストされたモデル エンドポイントで受け入れられるメディア タイプ。
ツールとエージェント
ツール呼び出し、エージェント、構成可能な推論バジェット厳選されたネイティブ ツールとエージェント構築機能。完全なリストではありません。

料金と比較

コストを見積もる

利用量を入力すると、見積もりが自動で更新されます。

例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。

1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。

詳細オプション

NVIDIA Nemotron 3 Ultra

NVIDIA

合計見積額(USD)

確認済み料金なし

上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)

見積もりの仕組み

税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。

APIとプロバイダーへのアクセス

NVIDIA Nemotron 3 Ultraの入手場所

可用性

地域とアクセス段階

無料の NVIDIA API プロトタイプ、パートナー エンドポイント、NVIDIA NIM デプロイメント、およびダウンロード可能なウェイトを通じて利用できます。

NVIDIA は、モデルのグローバル展開をリストします。実際のホスト領域とセルフホストの場所は、選択したエンドポイントまたはインフラストラクチャによって異なります。

ライブの空き状況を確認する

データとトレーニング

ルートは重要です。

ダウンロードされた重みは、オペレーターが制御するインフラストラクチャで実行できます。 NVIDIA のホスト型プロトタイプおよびパートナー エンドポイントには、独自のトライアル、ロギング、保持、展開の条件が適用されます。

これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。

プロバイダーポリシーを読む

よくある質問

NVIDIA Nemotron 3 Ultra よくある質問

NVIDIA Nemotron 3 Ultraとは何ですか?

複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。 Nemotron 3 Ultra は、各トークンに対して 5500 億のパラメーターを有効にする、5,500 億のパラメーターの専門家混合モデルです。これは、要求の厳しいエージェントおよび推論作業向けに構築されており、構成可能な推論バジェットで最大 100 万トークンのテキスト コンテキストをサポートします。

NVIDIA Nemotron 3 Ultra はいつリリースされましたか?

引用されたプロバイダーの資料によると、NVIDIA Nemotron 3 Ultra は 2026年6月4日 でリリースされました。

NVIDIA Nemotron 3 Ultra にはどこからアクセスできますか?

無料の NVIDIA API プロトタイプ、パートナー エンドポイント、NVIDIA NIM デプロイメント、およびダウンロード可能なウェイトを通じて利用できます。 このガイドに記載されているアクセスルートは NVIDIA NIM、Hugging Face です。

NVIDIA Nemotron 3 Ultraの価格はいくらですか?

無料の NVIDIA プロトタイプ エンドポイント。実稼働コストと自己ホストコストは異なります. NVIDIA は、プロトタイプ NIM エンドポイントとパートナーおよびダウンロード可能な展開ルートを提供します。実稼働ホスティングと GPU のコストは、選択したルートによって異なります。

NVIDIA Nemotron 3 Ultra はどこで入手できますか?

無料の NVIDIA API プロトタイプ、パートナー エンドポイント、NVIDIA NIM デプロイメント、およびダウンロード可能なウェイトを通じて利用できます。 NVIDIA は、モデルのグローバル展開をリストします。実際のホスト領域とセルフホストの場所は、選択したエンドポイントまたはインフラストラクチャによって異なります。

私の NVIDIA Nemotron 3 Ultra API データはトレーニングに使用されますか?

ダウンロードされた重みは、オペレーターが制御するインフラストラクチャで実行できます。 NVIDIA のホスト型プロトタイプおよびパートナー エンドポイントには、独自のトライアル、ロギング、保持、展開の条件が適用されます。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。

料金比較

表示APIの標準コンテキスト長での100万トークンあたりの米ドル料金。キャッシュや長いコンテキストの料金は異なる場合があります。対応する確認済み料金がないモデルは省略しています。安さは品質の高さを意味しません。

入力トークンの料金100万トークンあたり · USD
  1. $0.15
    Mistral Small 4

    Mistral AI

  2. $0.75
    Gemini 3.8 Flash

    Google

  3. $4.00
    GPT-5.6 Sol

    OpenAI

  4. $10.00
    GPT-6 Astra

    OpenAI

  5. $10.00
    Claude Fable 5.1

    Anthropic

出力トークンの料金100万トークンあたり · USD
  1. $0.60
    Mistral Small 4

    Mistral AI

  2. $3.75
    Gemini 3.8 Flash

    Google

  3. $20.00
    GPT-5.6 Sol

    OpenAI

  4. $50.00
    GPT-6 Astra

    OpenAI

  5. $50.00
    Claude Fable 5.1

    Anthropic

関連する比較

モデル別の詳細比較

  1. NVIDIA Nemotron 3 Ultra vs GPT-6 Astra

    OpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。

    完全な比較を開く
  2. NVIDIA Nemotron 3 Ultra vs GPT-5.6 Sol

    OpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。

    完全な比較を開く
  3. NVIDIA Nemotron 3 Ultra vs Claude Fable 5.1

    Anthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。

    完全な比較を開く
  4. NVIDIA Nemotron 3 Ultra vs Gemini 3.8 Flash

    Google のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。

    完全な比較を開く
  5. NVIDIA Nemotron 3 Ultra vs Grok 4.6

    ダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。

    完全な比較を開く
  6. NVIDIA Nemotron 3 Ultra vs Grok 4.20 Multi-Agent Beta

    複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。

    完全な比較を開く
  7. NVIDIA Nemotron 3 Ultra vs Inkling

    カスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。

    完全な比較を開く
  8. NVIDIA Nemotron 3 Ultra vs Mistral Medium 3.5

    256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。

    完全な比較を開く
  9. NVIDIA Nemotron 3 Ultra vs Mistral Small 4

    Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。

    完全な比較を開く
  10. NVIDIA Nemotron 3 Ultra vs Qwen3.8 Max

    ロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。

    完全な比較を開く
  11. NVIDIA Nemotron 3 Ultra vs MiniMax M3

    MiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。

    完全な比較を開く
  12. NVIDIA Nemotron 3 Ultra vs GLM-5.3

    Z.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。

    完全な比較を開く
  13. NVIDIA Nemotron 3 Ultra vs Kimi K3

    Moonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。

    完全な比較を開く
  14. NVIDIA Nemotron 3 Ultra vs Falcon-H1R-7B

    テキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。

    完全な比較を開く
  15. NVIDIA Nemotron 3 Ultra vs Falcon-H1-34B-Instruct

    多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。

    完全な比較を開く
  16. NVIDIA Nemotron 3 Ultra vs Muse Spark 1.3

    長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。

    完全な比較を開く
  17. NVIDIA Nemotron 3 Ultra vs Celeris-1 Magnus

    Celeris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。

    完全な比較を開く
  18. NVIDIA Nemotron 3 Ultra vs NVIDIA Nemotron 3.5 Lightning

    NVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。

    完全な比較を開く
  19. NVIDIA Nemotron 3 Ultra vs Qwen3.8-Flash

    Alibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。

    完全な比較を開く
  20. NVIDIA Nemotron 3 Ultra vs DeepSeek-V4-Pro

    DeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。

    完全な比較を開く
  21. NVIDIA Nemotron 3 Ultra vs DeepSeek-V4-Flash

    大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。

    完全な比較を開く