Alle Modelle
Mistral AI

Mistral Small 4

Das kostengünstigere offene Modell von Mistral, das normale Anweisungen, Argumentation, Kodierung, Vision und Agenten-Tools in einem Endpunkt vereint.

Übersicht in einfacher englischer Sprache

Was Mistral Small 4 eigentlich ist

Mistral Small 4 verwendet eine 119B-Mixed-of-Experts-Architektur mit 6,5B aktiven Parametern. Es ist so konzipiert, dass es die alltägliche Assistentenarbeit und tiefergehende Überlegungen abdeckt, ohne dass Entwickler zwischen separaten Anweisungs-, Argumentations- und Codierungsmodellen wechseln müssen.

Das Modell behält ein Kontextfenster von 256 KB bei und berechnet dabei deutlich weniger als Medium 3,5 auf der gehosteten API von Mistral. Apache-2.0-Gewichte machen es auch attraktiv, wenn ein Team lokale Kontrolle, benutzerdefinierte Bereitstellung oder eine Offline-Entwicklungsroute benötigt.

Gute Passform für

  • Kostenbewusste Produktionsassistenten
  • Codierung und Werkzeugnutzung auf einem flexiblen Modell
  • Selbstgehostete Text- und Bildanwendungen

Kategorievergleich

Die Fakten, die für die text-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Kontextfenster
Insgesamt 256.000 TokenMaximaler kombinierter Eingabeaufforderungs- und Arbeitskontext, der vom Anbieter dokumentiert wird.
Maximale Leistung
Nicht gesondert veröffentlichtVom Anbieter veröffentlichtes Antwortlimit, sofern verfügbar.
Wissensabbruch
Nicht veröffentlichtNeuestes verlässliches Wissensdatum, das ausdrücklich vom Modellanbieter veröffentlicht wird. Such- und verbundene Tools können neuere Informationen abrufen, ändern jedoch nicht den integrierten Cutoff des Modells.
Eingabepreis
0,15 $ / 1 MioAktueller Standardlistenpreis pro Million Input-Token, sofern nicht anders angegeben.
Ausgabepreis
0,60 $ / 1 MioAktueller Standardlistenpreis pro Million ausgegebener Token, sofern nicht anders angegeben.
Eingaben
Text, BildMedientypen, die vom aufgelisteten Modellendpunkt akzeptiert werden.
Tools und Agenten
Funktionen, Agenten, integrierte Tools, strukturierte und vorhergesagte AusgabenAusgewählte native Tools und Funktionen zur Agentenerstellung, keine erschöpfende Liste.

Preise und Vergleiche

Kosten schätzen

Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.

Beispiel: 6.000 Eingabe-Tokens für 10 Seiten und 500 für die Zusammenfassung. Seitenlängen variieren; passen Sie die Werte an.

Ein Durchlauf sendet Ihre Eingabe einmal an das Modell und erhält eine Antwort. Tokens sind Textbausteine: Eingabe ist, was Sie senden; Ausgabe ist die erhaltene Antwort.

Erweiterte Optionen

Mistral Small 4

Mistral AI

Geschätzte Summe (USD)

0,0012 $

Für die angegebene Nutzung · USD · API-Preis, kein Abonnement

Eingabe-Tokens
0,15 $ pro 1 Mio. Tokens
Ausgabe-Tokens
0,60 $ pro 1 Mio. Tokens
So funktioniert die Schätzung

Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.

API- und Provider-Zugriff

Wo bekomme ich Mistral Small 4?

Verfügbarkeit

Regionen und Zugriffsphase

Verfügbar über die Mistral-API und Studio sowie als offene Apache-2.0-Gewichte für Selbsthosting.

Gehostete regionale Inferenz wird über unterstützte EU- und US-Endpunkte gegen einen Aufpreis von 10 % angeboten; Durch das Selbsthosting erhält der Betreiber die direkte Kontrolle über die Region.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Die Geschäftsbedingungen von Mistral schließen Modellschulungen standardmäßig aus, es sei denn, ein Kunde entscheidet sich dafür oder nutzt bestimmte Labs oder Vorschaumodelle. Beim Selbsthosting bleiben die Inferenzdaten unter der Kontrolle des Betreibers. Die Aufbewahrung der gehosteten API beträgt im Allgemeinen 30 Tage, sofern keine Datenaufbewahrung ohne Null aktiviert ist.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

Mistral Small 4 FAQ

Was ist Mistral Small 4?

Das kostengünstigere offene Modell von Mistral, das normale Anweisungen, Argumentation, Kodierung, Vision und Agenten-Tools in einem Endpunkt vereint. Mistral Small 4 verwendet eine 119B-Mixed-of-Experts-Architektur mit 6,5B aktiven Parametern. Es ist so konzipiert, dass es die alltägliche Assistentenarbeit und tiefergehende Überlegungen abdeckt, ohne dass Entwickler zwischen separaten Anweisungs-, Argumentations- und Codierungsmodellen wechseln müssen.

Wann wurde Mistral Small 4 veröffentlicht?

Mistral Small 4 wurde gemäß den zitierten Anbietermaterialien auf 16. März 2026 veröffentlicht.

Wo kann ich auf Mistral Small 4 zugreifen?

Verfügbar über die Mistral-API und Studio sowie als offene Apache-2.0-Gewichte für Selbsthosting. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Mistral AI und Mistral Studio.

Wie viel kostet Mistral Small 4?

0,15 $ Input · 0,60 $ Output / 1 Mio. Token. Mistrals standardmäßiger gehosteter Listenpreis. Die Gewichte sind Apache 2.0; Die Kosten für die Selbstverwaltung hängen von der Infrastruktur ab.

Wo ist Mistral Small 4 erhältlich?

Verfügbar über die Mistral-API und Studio sowie als offene Apache-2.0-Gewichte für Selbsthosting. Gehostete regionale Inferenz wird über unterstützte EU- und US-Endpunkte gegen einen Aufpreis von 10 % angeboten; Durch das Selbsthosting erhält der Betreiber die direkte Kontrolle über die Region.

Werden meine Mistral Small 4-API-Daten für das Training verwendet?

Die Geschäftsbedingungen von Mistral schließen Modellschulungen standardmäßig aus, es sei denn, ein Kunde entscheidet sich dafür oder nutzt bestimmte Labs oder Vorschaumodelle. Beim Selbsthosting bleiben die Inferenzdaten unter der Kontrolle des Betreibers. Die Aufbewahrung der gehosteten API beträgt im Allgemeinen 30 Tage, sofern keine Datenaufbewahrung ohne Null aktiviert ist. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.

Preisvergleich

USD pro Million Tokens für die gezeigten API-Zugänge bei Standardkontext. Cache- und Langkontextpreise können abweichen. Modelle ohne passende geprüfte Preise fehlen; günstigere Kosten bedeuten keine bessere Qualität.

Kosten für Eingabe-Tokenspro 1 Mio. Tokens · USD
  1. 0,15 $
    Mistral Small 4

    Mistral AI

    Dieses Modell

  2. 0,75 $
    Gemini 3.8 Flash

    Google

  3. 4,00 $
    GPT-5.6 Sol

    OpenAI

  4. 10,00 $
    GPT-6 Astra

    OpenAI

  5. 10,00 $
    Claude Fable 5.1

    Anthropic

Kosten für Ausgabe-Tokenspro 1 Mio. Tokens · USD
  1. 0,60 $
    Mistral Small 4

    Mistral AI

    Dieses Modell

  2. 3,75 $
    Gemini 3.8 Flash

    Google

  3. 20,00 $
    GPT-5.6 Sol

    OpenAI

  4. 50,00 $
    GPT-6 Astra

    OpenAI

  5. 50,00 $
    Claude Fable 5.1

    Anthropic

Verwandte Vergleiche

Direktvergleiche

  1. Mistral Small 4 vs GPT-6 Astra

    Das leistungsfähigste Modell von OpenAI für schwierige End-to-End-Arbeiten, das Grenzüberlegungen mit einem Millionen-Token-Kontextfenster und einer breiten Palette von Agententools kombiniert.

    Vollständigen Vergleich öffnen
  2. Mistral Small 4 vs GPT-5.6 Sol

    Das Flaggschiff-Allgemeinmodell von OpenAI für schwierige Codierung, Analyse und professionelle Arbeit, mit einem sehr großen Kontextfenster und einem breiten nativen Toolset.

    Vollständigen Vergleich öffnen
  3. Mistral Small 4 vs Claude Fable 5.1

    Das Grenzmodell von Anthropic für ehrgeizige, langwierige Agenten- und Codierungsarbeiten mit starker Vision und Verfügbarkeit auf dem Unternehmensmarkt.

    Vollständigen Vergleich öffnen
  4. Mistral Small 4 vs Gemini 3.8 Flash

    Das stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe.

    Vollständigen Vergleich öffnen
  5. Mistral Small 4 vs Grok 4.6

    SpaceXAIs grenzüberschreitendes Text- und Bildmodell für Codierung, Agentenaufgaben und Wissensarbeit mit direkten Web-, X- und Code-Tools.

    Vollständigen Vergleich öffnen
  6. Mistral Small 4 vs Grok 4.20 Multi-Agent Beta

    Ein spezialisiertes Grok-Modell, das mehrere KI-Agenten parallel zur Untersuchung einer schwierigen Frage entsendet und ihre Arbeit dann zu einer recherchierten Antwort zusammenfasst.

    Vollständigen Vergleich öffnen
  7. Mistral Small 4 vs Inkling

    Das große Open-Weights-Modell von Thinking Machines Lab für anpassbare Argumentations-, Codierungs-, Tools-, Vision- und Audio-Workflows.

    Vollständigen Vergleich öffnen
  8. Mistral Small 4 vs Mistral Medium 3.5

    Mistrals Open-Weight-Frontier-Modell für anspruchsvolle multimodale Codierungs-, Argumentations- und Agenten-Workflows mit einem 256K-Kontextfenster.

    Vollständigen Vergleich öffnen
  9. Mistral Small 4 vs Qwen3.8 Max

    Das Grenzmodell

    Vollständigen Vergleich öffnen
  10. Mistral Small 4 vs MiniMax M3

    Das Millionen-Token-multimodale Modell von MiniMax für Codierung, Agenten, Computernutzung und lange Projekte zu einem niedrigen direkten API-Preis.

    Vollständigen Vergleich öffnen
  11. Mistral Small 4 vs GLM-5.3

    Das offene Argumentationsmodell mit langem Kontext von Z.ai für Codierung, Tools und Agentenarbeit auf selbst gehosteten und verwalteten Routen.

    Vollständigen Vergleich öffnen
  12. Mistral Small 4 vs Kimi K3

    Moonshot AIs multimodales Grenzmodell für Millionen-Token-Codierung, Argumentation, Wissensarbeit und werkzeuggesteuerte Agenten.

    Vollständigen Vergleich öffnen
  13. Mistral Small 4 vs Falcon-H1R-7B

    Das kompakte offene Argumentationsmodell von TII für Textaufgaben, lange Kontexte und selbstgehostete Funktionsaufruf-Workflows.

    Vollständigen Vergleich öffnen
  14. Mistral Small 4 vs Falcon-H1-34B-Instruct

    Das offene 34B-Instruktionsmodell von TII für mehrsprachigen Text, Codierung und kontrollierte selbst gehostete Anwendungen.

    Vollständigen Vergleich öffnen
  15. Mistral Small 4 vs Muse Spark 1.3

    Metas neuestes multimodales Argumentationsmodell für lang laufende Agenten, Codierung, Tools und komplexe Benutzerzusammenarbeit.

    Vollständigen Vergleich öffnen
  16. Mistral Small 4 vs Celeris-1 Magnus

    Das agentenorientierte Diffusionssprachmodell von Celeris für schnelles Denken, Tool-Schleifen, strukturierte Aktionen und OpenAI-kompatible Integration.

    Vollständigen Vergleich öffnen
  17. Mistral Small 4 vs NVIDIA Nemotron 3 Ultra

    NVIDIAs größtes Nemotron 3-Argumentationsmodell für komplexe Agenten, Codierung, Planung, Tools, RAG und Millionen-Token-Analyse.

    Vollständigen Vergleich öffnen
  18. Mistral Small 4 vs NVIDIA Nemotron 3.5 Lightning

    Das kompakte 30B-Expertenmodell von NVIDIA für effiziente Spezialagenten und Text-Workflows mit hohem Volumen.

    Vollständigen Vergleich öffnen
  19. Mistral Small 4 vs Qwen3.8-Flash

    Das effiziente multimodale Millionen-Kontext-Modell von Alibaba für schnelle Agenten, Codierung, Dokumentenarbeit, Vision, Videoverständnis und Werkzeugnutzung.

    Vollständigen Vergleich öffnen
  20. Mistral Small 4 vs DeepSeek-V4-Pro

    DeepSeeks Flaggschiff-Millionen-Kontext-Textmodell für schwierige Argumentation, Codierung, lang laufende Agenten, Tools und sehr große Ausgaben.

    Vollständigen Vergleich öffnen
  21. Mistral Small 4 vs DeepSeek-V4-Flash

    Das kostengünstigere V4-Modell von DeepSeek für umfangreiche Argumentations-, Codierungs-, Agenten- und Millionen-Token-Text-Workloads.

    Vollständigen Vergleich öffnen