Mistral Small 4
Tańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta.
Tańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta.
Przegląd w prostym języku angielskim
Mistral Small 4 wykorzystuje architekturę mieszaną 119B z aktywnymi parametrami 6,5B. Został zaprojektowany z myślą o codziennej pracy asystenta i głębszym rozumowaniu, bez zmuszania programistów do przełączania się między oddzielnymi modelami instruowania, rozumowania i kodowania.
Model utrzymuje okno kontekstowe 256 KB, ładując znacznie mniej niż Medium 3.5 w hostowanym API Mistral. Wagi Apache-2.0 sprawiają, że jest on atrakcyjny również wtedy, gdy zespół potrzebuje lokalnej kontroli, niestandardowej obsługi lub ścieżki programowania w trybie offline.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Przykład: 6000 tokenów wejścia dla 10 stron i 500 na podsumowanie. Długość stron bywa różna; dostosuj wartości.
Jedno wykonanie wysyła dane do modelu i odbiera odpowiedź. Tokeny to fragmenty tekstu: wejście to treść wysłana, a wyjście to otrzymana odpowiedź.
Mistral Small 4
Mistral AI
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Dostępne poprzez Mistral API i Studio oraz jako otwarte wagi Apache-2.0 do samodzielnego hostingu.
Hostowane wnioskowanie regionalne jest oferowane za pośrednictwem obsługiwanych punktów końcowych w UE i USA za dopłatą 10%; Self-hosting daje operatorowi bezpośrednią kontrolę nad regionem.
Sprawdź dostępność na żywoDane i szkolenia
Warunki handlowe firmy Mistral domyślnie wykluczają szkolenie modeli, z wyjątkiem sytuacji, gdy klient wyrazi zgodę lub skorzysta z wyznaczonych laboratoriów lub modeli poglądowych. Self-hosting utrzymuje dane wnioskowane pod kontrolą operatora; Przechowywanie hostowanego interfejsu API wynosi zazwyczaj 30 dni, chyba że włączono opcję zerowego przechowywania danych.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Tańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta. Mistral Small 4 wykorzystuje architekturę mieszaną 119B z aktywnymi parametrami 6,5B. Został zaprojektowany z myślą o codziennej pracy asystenta i głębszym rozumowaniu, bez zmuszania programistów do przełączania się między oddzielnymi modelami instruowania, rozumowania i kodowania.
Według materiałów cytowanego dostawcy Mistral Small 4 został wydany na 16 marca 2026.
Dostępne poprzez Mistral API i Studio oraz jako otwarte wagi Apache-2.0 do samodzielnego hostingu. Drogi dostępu wymienione w tym przewodniku to Mistral AI i Mistral Studio.
Wejście 0,15 $ · Wyjście 0,60 $ / 1 milion tokenów. Standardowa cena katalogowa hostingu Mistral. Wagi to Apache 2.0; Koszt samodzielnego hostingu zależy od infrastruktury.
Dostępne poprzez Mistral API i Studio oraz jako otwarte wagi Apache-2.0 do samodzielnego hostingu. Hostowane wnioskowanie regionalne jest oferowane za pośrednictwem obsługiwanych punktów końcowych w UE i USA za dopłatą 10%; Self-hosting daje operatorowi bezpośrednią kontrolę nad regionem.
Warunki handlowe firmy Mistral domyślnie wykluczają szkolenie modeli, z wyjątkiem sytuacji, gdy klient wyrazi zgodę lub skorzysta z wyznaczonych laboratoriów lub modeli poglądowych. Self-hosting utrzymuje dane wnioskowane pod kontrolą operatora; Przechowywanie hostowanego interfejsu API wynosi zazwyczaj 30 dni, chyba że włączono opcję zerowego przechowywania danych. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
USD za milion tokenów dla podanych API przy standardowej długości kontekstu. Stawki cache i długiego kontekstu mogą się różnić. Pomijamy modele bez zgodnych, sprawdzonych cen; niższy koszt nie oznacza lepszej jakości.
Mistral AI
Ten model
OpenAI
OpenAI
Anthropic
Mistral AI
Ten model
OpenAI
OpenAI
Anthropic
Powiązane porównania
Najbardziej wydajny model OpenAI do trudnej, kompleksowej pracy, łączący rozumowanie pionierskie z oknem kontekstowym obejmującym milion tokenów i szerokim zestawem narzędzi agenta.
Otwórz pełne porównanieFlagowy ogólny model OpenAI do trudnego kodowania, analiz i pracy zawodowej, z bardzo dużym oknem kontekstowym i szerokim natywnym zestawem narzędzi.
Otwórz pełne porównanieFrontierowy model Anthropic do ambitnych, długotrwałych prac agentowych i programistycznych, z silną wizją i dostępnością na rynku korporacyjnym.
Otwórz pełne porównanieStabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash.
Otwórz pełne porównanieFrontierowy model tekstu i obrazu SpaceXAI do kodowania, zadań agentowych i pracy opartej na wiedzy, z narzędziami Direct Web, X i kodowaniem.
Otwórz pełne porównanieSpecjalistyczny model Groka, który wysyła kilku agentów AI równolegle do zbadania trudnego pytania, a następnie łączy ich pracę w jedną zbadaną odpowiedź.
Otwórz pełne porównanieDuży model z otwartymi ciężarami Thinking Machines Lab umożliwiający dostosowywanie procesów wnioskowania, kodowania, narzędzi, wizji i dźwięku.
Otwórz pełne porównanieModel frontierowy firmy Mistral o otwartej wadze, przeznaczony do wymagających przepływów pracy multimodalnych, kodowania, wnioskowania i agentów, z oknem kontekstowym o wielkości 256 tys.
Otwórz pełne porównanieFrontierowy model Alibaba Qwen do wnioskowania w długim kontekście, kodowania, narzędzi i rozumienia tekstu, obrazów i wideo.
Otwórz pełne porównanieMultimodalny model MiniMax z milionem tokenów do kodowania, agentów, korzystania z komputera i długich projektów w niskiej cenie bezpośredniego interfejsu API.
Otwórz pełne porównanieOtwarty model wnioskowania o długim kontekście Z.ai do kodowania, narzędzi i pracy agentowej w ramach tras hostowanych samodzielnie i zarządzanych.
Otwórz pełne porównanieFrontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach.
Otwórz pełne porównanieKompaktowy, otwarty model wnioskowania TII do zadań tekstowych, długich kontekstów i samodzielnie hostowanych przepływów pracy z wywołaniami funkcji.
Otwórz pełne porównanieModel otwartych instrukcji TII 34B do wielojęzycznego tekstu, kodowania i kontrolowanych aplikacji hostowanych samodzielnie.
Otwórz pełne porównanieNajnowszy multimodalny model wnioskowania Meta dla długotrwałych agentów, kodowania, narzędzi i złożonej współpracy użytkowników.
Otwórz pełne porównanieModel języka dyfuzyjnego skoncentrowanego na agentach Celeris umożliwiający szybkie wnioskowanie, pętle narzędzi, działania strukturalne i integrację kompatybilną z OpenAI.
Otwórz pełne porównanieNajwiększy model wnioskowania Nemotron 3 firmy NVIDIA do obsługi złożonych agentów, kodowania, planowania, narzędzi, RAG i analizy milionów tokenów.
Otwórz pełne porównanieKompaktowy model NVIDIA 30B, będący mieszanką ekspertów, przeznaczony dla wydajnych agentów specjalistycznych i obiegów pracy z dużą ilością tekstów.
Otwórz pełne porównanieWydajny wielomodalny model Alibaba z milionem kontekstów do szybkich agentów, kodowania, pracy z dokumentami, wizji, rozumienia wideo i korzystania z narzędzi.
Otwórz pełne porównanieFlagowy model tekstu DeepSeek z milionem kontekstów do trudnego wnioskowania, kodowania, długotrwałych agentów, narzędzi i bardzo dużych wyników.
Otwórz pełne porównanieTańszy model V4 DeepSeek do dużych obciążeń związanych z wnioskowaniem, kodowaniem, agentami i milionami tokenów tekstowych.
Otwórz pełne porównanie