平易な英語による概要
NVIDIA Nemotron 3.5 Lightning とは実際には何ですか
Nemotron 3.5 Lightning には合計 300 億のパラメータがありますが、トークンごとに約 30 億がアクティブになります。 NVIDIA は、最大 100 万トークンのコンテキスト ウィンドウを保持しながら、大規模なエージェント システム内の特殊なタスクのための高速な主力製品として設計されました。
プレビューは、ダウンロード可能なウェイトとして、NVIDIA、OpenRouter、およびパートナー インフラストラクチャ全体で利用できます。アクティブなフットプリントが小さいため、Ultra よりも制御されたデプロイメントが容易になりますが、長いコンテキストと同時実行性が依然としてメモリ使用量を支配する可能性があります。
ぴったりフィット
- 大量のエージェントのサブタスク
- 効率的な自己ホスト型推論
- ロングコンテキスト RAG および指示ワークフロー
カテゴリ比較
テキスト モデルにとって重要な事実
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
- コンテキストウィンドウ
- 最大100万トークンプロバイダーによって文書化されたプロンプトと作業コンテキストを組み合わせた最大数。
- 最大出力
- 個別に公開されていないプロバイダーが公開している応答制限(利用可能な場合)。
- 知識の遮断
- 2025 年 9 月までの事前トレーニング。トレーニング後から 2026 年 5 月までモデルプロバイダーによって明示的に公開された、信頼できる最新の知識の日付。検索ツールと接続ツールは新しい情報を取得できますが、モデルの組み込みカットオフは変更しません。
- 入力価格
- 無料のプロトタイプまたは導入コストCurrent standard list price per million input tokens unless noted.
- 出力価格
- 無料のプロトタイプまたは導入コストCurrent standard list price per million output tokens unless noted.
- 入力
- テキストリストされたモデル エンドポイントで受け入れられるメディア タイプ。
- ツールとエージェント
- エージェントツールと長期実行ワークフロー厳選されたネイティブ ツールとエージェント構築機能。完全なリストではありません。
料金と比較
コストを見積もる
利用量を入力すると、見積もりが自動で更新されます。
例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。
1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。
詳細オプション
NVIDIA Nemotron 3.5 Lightning
NVIDIA
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
見積もりの仕組み
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
NVIDIA Nemotron 3.5 Lightningの入手場所
可用性
地域とアクセス段階
NVIDIA ビルド、Hugging Face、ModelScope、OpenRouter、NVIDIA NIM、およびクラウドまたは推論パートナーで利用できます。
モデル カードはグローバル展開について説明しています。実際の処理領域は、選択したプロバイダーまたはセルフホスト型インフラストラクチャによって異なります。
ライブの空き状況を確認するデータとトレーニング
ルートは重要です。
自己ホスト型ウェイトは、リクエスト データをオペレーターの制御下に保ちます。 NVIDIA API トライアル、OpenRouter、およびクラウド パートナーはそれぞれ、個別のログ記録、保持、およびトレーニング使用ポリシーを適用します。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
NVIDIA Nemotron 3.5 Lightning よくある質問
NVIDIA Nemotron 3.5 Lightningとは何ですか?
NVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。 Nemotron 3.5 Lightning には合計 300 億のパラメータがありますが、トークンごとに約 30 億がアクティブになります。 NVIDIA は、最大 100 万トークンのコンテキスト ウィンドウを保持しながら、大規模なエージェント システム内の特殊なタスクのための高速な主力製品として設計されました。
NVIDIA Nemotron 3.5 Lightning はいつリリースされましたか?
引用されたプロバイダーの資料によると、NVIDIA Nemotron 3.5 Lightning は 2026年8月11日 でリリースされました。
NVIDIA Nemotron 3.5 Lightning にはどこからアクセスできますか?
NVIDIA ビルド、Hugging Face、ModelScope、OpenRouter、NVIDIA NIM、およびクラウドまたは推論パートナーで利用できます。 このガイドに記載されているアクセスルートは NVIDIA NIM、NVIDIA です。
NVIDIA Nemotron 3.5 Lightningの価格はいくらですか?
無料の NVIDIA プロトタイプ エンドポイント。実稼働コストと自己ホストコストは異なります. プレビューは、ダウンロード可能なウェイトとして、NVIDIA およびパートナー ルートを通じて利用できます。ハードウェア、NIM、およびプロバイダーの価格は別個です。
NVIDIA Nemotron 3.5 Lightning はどこで入手できますか?
NVIDIA ビルド、Hugging Face、ModelScope、OpenRouter、NVIDIA NIM、およびクラウドまたは推論パートナーで利用できます。 モデル カードはグローバル展開について説明しています。実際の処理領域は、選択したプロバイダーまたはセルフホスト型インフラストラクチャによって異なります。
私の NVIDIA Nemotron 3.5 Lightning API データはトレーニングに使用されますか?
自己ホスト型ウェイトは、リクエスト データをオペレーターの制御下に保ちます。 NVIDIA API トライアル、OpenRouter、およびクラウド パートナーはそれぞれ、個別のログ記録、保持、およびトレーニング使用ポリシーを適用します。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
料金比較
表示APIの標準コンテキスト長での100万トークンあたりの米ドル料金。キャッシュや長いコンテキストの料金は異なる場合があります。対応する確認済み料金がないモデルは省略しています。安さは品質の高さを意味しません。
- Mistral Small 4$0.15
Mistral AI
- Gemini 3.8 Flash$0.75
Google
- GPT-5.6 Sol$4.00
OpenAI
- GPT-6 Astra$10.00
OpenAI
- Claude Fable 5.1$10.00
Anthropic
- Mistral Small 4$0.60
Mistral AI
- Gemini 3.8 Flash$3.75
Google
- GPT-5.6 Sol$20.00
OpenAI
- GPT-6 Astra$50.00
OpenAI
- Claude Fable 5.1$50.00
Anthropic
関連する比較
モデル別の詳細比較
NVIDIA Nemotron 3.5 Lightning vs GPT-6 Astra
OpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs GPT-5.6 Sol
OpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Claude Fable 5.1
Anthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Gemini 3.8 Flash
Google のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Grok 4.6
ダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Grok 4.20 Multi-Agent Beta
複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Inkling
カスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Mistral Medium 3.5
256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Mistral Small 4
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Qwen3.8 Max
ロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs MiniMax M3
MiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs GLM-5.3
Z.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Kimi K3
Moonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Falcon-H1R-7B
テキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Falcon-H1-34B-Instruct
多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Muse Spark 1.3
長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Celeris-1 Magnus
Celeris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs NVIDIA Nemotron 3 Ultra
複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs Qwen3.8-Flash
Alibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Pro
DeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。
完全な比較を開くNVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Flash
大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。
完全な比較を開く