Mistral Small 4
Le modèle ouvert à moindre coût de Mistral qui combine les outils normaux de suivi des instructions, de raisonnement, de codage, de vision et d'agent dans un seul point de terminaison.
Le modèle ouvert à moindre coût de Mistral qui combine les outils normaux de suivi des instructions, de raisonnement, de codage, de vision et d'agent dans un seul point de terminaison.
Présentation de l'anglais simple
Mistral Small 4 utilise une architecture composée d'un mélange d'experts de 119 B avec 6,5 B de paramètres actifs. Il est conçu pour couvrir le travail quotidien des assistants et un raisonnement plus approfondi sans obliger les développeurs à basculer entre des modèles d'instruction, de raisonnement et de codage distincts.
Le modèle conserve une fenêtre contextuelle de 256 Ko tout en facturant nettement moins que Medium 3.5 sur l'API hébergée de Mistral. Les pondérations Apache-2.0 le rendent également attrayant lorsqu'une équipe a besoin d'un contrôle local, d'un service personnalisé ou d'une voie de développement hors ligne.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Tarifs et comparaisons
Indiquez votre utilisation. L’estimation se met à jour à chaque modification.
Exemple : 6 000 tokens d’entrée pour 10 pages et 500 pour le résumé. La longueur varie ; ajustez les valeurs.
Une exécution envoie votre entrée au modèle une fois et reçoit une réponse. Les tokens sont des fragments de texte : l’entrée est ce que vous envoyez, la sortie est la réponse reçue.
Mistral Small 4
Mistral AI
Total estimé (USD)
Pour l’utilisation indiquée · USD · Tarif API, hors abonnement
Les estimations excluent taxes, outils, stockage/écriture du cache, quotas gratuits et remises personnalisées. Pour les images, seule la sortie est incluse, pas le prompt ni les références. Les modes de qualité varient. Un paramètre non répertorié n’est pas gratuit.
Accès API et fournisseur
Disponibilité
Disponible via l'API Mistral et Studio et en tant que poids ouverts Apache-2.0 pour l'auto-hébergement.
L'inférence régionale hébergée est proposée via les points de terminaison pris en charge dans l'UE et aux États-Unis moyennant un supplément de 10 % ; l'auto-hébergement donne à l'opérateur un contrôle direct de la région.
Vérifier la disponibilité en directDonnées et formation
Les conditions commerciales de Mistral excluent par défaut la formation de modèles, sauf lorsqu'un client s'inscrit ou utilise des laboratoires désignés ou des modèles de prévisualisation. L'auto-hébergement maintient les données d'inférence sous le contrôle de l'opérateur ; La conservation des API hébergées est généralement de 30 jours, sauf si la conservation des données nulles est activée.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
Le modèle ouvert à moindre coût de Mistral qui combine les outils normaux de suivi des instructions, de raisonnement, de codage, de vision et d'agent dans un seul point de terminaison. Mistral Small 4 utilise une architecture composée d'un mélange d'experts de 119 B avec 6,5 B de paramètres actifs. Il est conçu pour couvrir le travail quotidien des assistants et un raisonnement plus approfondi sans obliger les développeurs à basculer entre des modèles d'instruction, de raisonnement et de codage distincts.
Mistral Small 4 a été publié sur 16 mars 2026 selon les documents du fournisseur cités.
Disponible via l'API Mistral et Studio et en tant que poids ouverts Apache-2.0 pour l'auto-hébergement. Les voies d'accès répertoriées dans ce guide sont Mistral AI et Mistral Studio.
0,15 $ d'entrée · 0,60 $ de sortie / 1 million de jetons. Le prix catalogue hébergé standard de Mistral. Les pondérations sont Apache 2.0 ; le coût auto-hébergé dépend de l’infrastructure.
Disponible via l'API Mistral et Studio et en tant que poids ouverts Apache-2.0 pour l'auto-hébergement. L'inférence régionale hébergée est proposée via les points de terminaison pris en charge dans l'UE et aux États-Unis moyennant un supplément de 10 % ; l'auto-hébergement donne à l'opérateur un contrôle direct de la région.
Les conditions commerciales de Mistral excluent par défaut la formation de modèles, sauf lorsqu'un client s'inscrit ou utilise des laboratoires désignés ou des modèles de prévisualisation. L'auto-hébergement maintient les données d'inférence sous le contrôle de l'opérateur ; La conservation des API hébergées est généralement de 30 jours, sauf si la conservation des données nulles est activée. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
USD par million de tokens pour les API indiquées avec un contexte standard. Les tarifs de cache et de contexte long peuvent varier. Les modèles sans prix vérifiés compatibles sont omis ; un coût inférieur n’indique pas une meilleure qualité.
Mistral AI
Ce modèle
OpenAI
OpenAI
Anthropic
Mistral AI
Ce modèle
OpenAI
OpenAI
Anthropic
Comparaisons associées
Le modèle OpenAI le plus performant pour les travaux difficiles de bout en bout, combinant le raisonnement aux frontières avec une fenêtre contextuelle d'un million de jetons et un large ensemble d'outils d'agent.
Ouvrir la comparaison complèteLe modèle général phare de OpenAI pour le codage, l'analyse et le travail professionnel difficiles, avec une très grande fenêtre contextuelle et un large ensemble d'outils natifs.
Ouvrir la comparaison complèteLe modèle pionnier de Anthropic pour un travail d'agent et de codage ambitieux et de longue durée, avec une vision forte et une disponibilité sur le marché des entreprises.
Ouvrir la comparaison complèteLe modèle multimodal stable et à haute efficacité de Google pour les agents, le travail logiciel et les grandes entrées multimédias à un prix de lancement de niveau Flash.
Ouvrir la comparaison complèteModèle texte et image frontalier de SpaceXAI pour le codage, les tâches agents et le travail de connaissances, avec des outils directs Web, X et de code.
Ouvrir la comparaison complèteUn modèle Grok spécialisé qui envoie plusieurs agents d'IA enquêter en parallèle sur une question difficile, puis combine leur travail en une seule réponse recherchée.
Ouvrir la comparaison complèteGrand modèle à pondérations ouvertes de Thinking Machines Lab pour des flux de travail personnalisables de raisonnement, de codage, d'outils, de vision et d'audio.
Ouvrir la comparaison complèteLe modèle frontière ouvert de Mistral pour les flux de travail multimodaux, de codage, de raisonnement et d'agent exigeants, avec une fenêtre contextuelle de 256 Ko.
Ouvrir la comparaison complèteModèle Qwen frontière de Alibaba pour le raisonnement, le codage, les outils et la compréhension de textes, d'images et de vidéos en contexte long.
Ouvrir la comparaison complèteLe modèle multimodal à un million de jetons de MiniMax pour le codage, les agents, l'utilisation de l'ordinateur et les projets longs à un faible prix API direct.
Ouvrir la comparaison complèteModèle de raisonnement à contexte long et ouvert de Z.ai pour le codage, les outils et le travail agent sur des routes auto-hébergées et gérées.
Ouvrir la comparaison complèteLe modèle multimodal frontière de Moonshot AI pour le codage à un million de jetons, le raisonnement, le travail de connaissances et les agents pilotés par des outils.
Ouvrir la comparaison complèteLe modèle de raisonnement ouvert et compact de TII pour les tâches de texte, les contextes longs et les workflows d'appel de fonctions auto-hébergés.
Ouvrir la comparaison complèteModèle d'instruction ouvert 34B de TII pour le texte multilingue, le codage et les applications auto-hébergées contrôlées.
Ouvrir la comparaison complèteLe dernier modèle de raisonnement multimodal de Meta pour les agents, le codage, les outils et la collaboration utilisateur complexe de longue durée.
Ouvrir la comparaison complèteModèle de langage de diffusion axé sur les agents de Celeris pour un raisonnement rapide, des boucles d'outils, des actions structurées et une intégration compatible OpenAI.
Ouvrir la comparaison complèteLe plus grand modèle de raisonnement Nemotron 3 de NVIDIA pour les agents complexes, le codage, la planification, les outils, RAG et l'analyse d'un million de jetons.
Ouvrir la comparaison complèteModèle compact de mélange d'experts 30B du NVIDIA pour des agents spécialisés efficaces et des flux de travail de texte à volume élevé.
Ouvrir la comparaison complèteLe modèle multimodal efficace d'un million de contextes de Alibaba pour des agents rapides, le codage, le travail documentaire, la vision, la compréhension vidéo et l'utilisation d'outils.
Ouvrir la comparaison complèteLe modèle de texte phare d'un million de contextes de DeepSeek pour le raisonnement difficile, le codage, les agents et les outils de longue durée et les résultats de très grande taille.
Ouvrir la comparaison complèteLe modèle V4 à moindre coût de DeepSeek pour les charges de travail de raisonnement, de codage, d'agents et de texte à volume élevé.
Ouvrir la comparaison complète