Mistral Small 4
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
平易な英語による概要
Mistral Small 4 は、6.5B のアクティブ パラメータを備えた 119B の専門家混合アーキテクチャを使用します。これは、開発者が個別の指示、推論、コーディング モデルを切り替えることなく、日常のアシスタント作業とより深い推論をカバーできるように設計されています。
このモデルは 256K のコンテキスト ウィンドウを維持しながら、Mistral のホスト型 API での料金は Medium 3.5 より大幅に低くなります。 Apache-2.0 の重みは、チームがローカル制御、カスタム提供、またはオフライン開発ルートを必要とする場合にも魅力的です。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。
1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。
Mistral Small 4
Mistral AI
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。
ホストされた地域推論は、サポートされている EU および米国のエンドポイントを通じて 10% の追加料金で提供されます。セルフホスティングにより、オペレータは直接領域を制御できます。
ライブの空き状況を確認するデータとトレーニング
Mistral の商業条件では、顧客がオプトインするか、指定されたラボまたはプレビュー モデルを使用する場合を除き、デフォルトでモデル トレーニングが除外されます。セルフホスティングは、推論データをオペレーターの制御下に保ちます。ホスト型 API の保持期間は、ゼロ データ保持が有効になっていない限り、通常 30 日間です。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。 Mistral Small 4 は、6.5B のアクティブ パラメータを備えた 119B の専門家混合アーキテクチャを使用します。これは、開発者が個別の指示、推論、コーディング モデルを切り替えることなく、日常のアシスタント作業とより深い推論をカバーできるように設計されています。
引用されたプロバイダーの資料によると、Mistral Small 4 は 2026年3月16日 でリリースされました。
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。 このガイドに記載されているアクセスルートは Mistral AI、Mistral Studio です。
0.15 ドルのインプット · 0.60 ドルのアウトプット / 100 万トークン. ミストラルの標準ホスト型定価。重みは Apache 2.0 です。セルフホスト型のコストはインフラストラクチャによって異なります。
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。 ホストされた地域推論は、サポートされている EU および米国のエンドポイントを通じて 10% の追加料金で提供されます。セルフホスティングにより、オペレータは直接領域を制御できます。
Mistral の商業条件では、顧客がオプトインするか、指定されたラボまたはプレビュー モデルを使用する場合を除き、デフォルトでモデル トレーニングが除外されます。セルフホスティングは、推論データをオペレーターの制御下に保ちます。ホスト型 API の保持期間は、ゼロ データ保持が有効になっていない限り、通常 30 日間です。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
表示APIの標準コンテキスト長での100万トークンあたりの米ドル料金。キャッシュや長いコンテキストの料金は異なる場合があります。対応する確認済み料金がないモデルは省略しています。安さは品質の高さを意味しません。
Mistral AI
このモデル
OpenAI
OpenAI
Anthropic
Mistral AI
このモデル
OpenAI
OpenAI
Anthropic
関連する比較
OpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。
完全な比較を開くOpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。
完全な比較を開くAnthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。
完全な比較を開くGoogle のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。
完全な比較を開くダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。
完全な比較を開く複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。
完全な比較を開くカスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
完全な比較を開く256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。
完全な比較を開くロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。
完全な比較を開くMiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。
完全な比較を開くZ.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。
完全な比較を開くMoonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。
完全な比較を開くテキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
完全な比較を開く多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。
完全な比較を開く長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。
完全な比較を開くCeleris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。
完全な比較を開く複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。
完全な比較を開くNVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。
完全な比較を開くAlibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。
完全な比較を開くDeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。
完全な比較を開く大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。
完全な比較を開く