Kimi K3
Frontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach.
Frontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach.
Przegląd w prostym języku angielskim
Kimi K3 może pracować z tekstem i obrazami, zachowując do miliona tokenów kontekstu. Moonshot kładzie nacisk na długie procesy kodowania i agentów, oferując poziomy rozumowania i wykorzystanie narzędzi dostępne za pośrednictwem bezpośredniej platformy programistycznej i wybranych partnerów.
Ceny bezpośrednie oddzielają dane wejściowe zapisane w pamięci podręcznej i niezapisane w pamięci podręcznej, co może sprawić, że powtarzające się duże konteksty będą znacznie tańsze, jeśli aplikacja zostanie zaprojektowana do ich ponownego wykorzystania. OpenRouter i inni dostawcy mają własne stawki i zasady operacyjne.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Przykład: 6000 tokenów wejścia dla 10 stron i 500 na podsumowanie. Długość stron bywa różna; dostosuj wartości.
Jedno wykonanie wysyła dane do modelu i odbiera odpowiedź. Tokeny to fragmenty tekstu: wejście to treść wysłana, a wyjście to otrzymana odpowiedź.
Kimi K3
Moonshot AI
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Dostępne za pośrednictwem platformy programistycznej Kimi i wybranych dostawców, w tym OpenRouter i QwenCloud.
Bezpośrednia platforma Kimi działa zgodnie z opublikowanymi warunkami Moonshot; Obsługa regionu i kraju strony trzeciej zależy od wybranego dostawcy.
Sprawdź dostępność na żywoDane i szkolenia
Warunki prywatności interfejsu API Moonshot i korzystania z modelu umożliwiają przechowywanie przesłanych treści i wykorzystywanie ich w celu świadczenia, utrzymywania, rozwijania i ulepszania usługi. Przed wysłaniem wrażliwych materiałów uzyskaj odpowiednie warunki korporacyjne.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Frontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach. Kimi K3 może pracować z tekstem i obrazami, zachowując do miliona tokenów kontekstu. Moonshot kładzie nacisk na długie procesy kodowania i agentów, oferując poziomy rozumowania i wykorzystanie narzędzi dostępne za pośrednictwem bezpośredniej platformy programistycznej i wybranych partnerów.
Według materiałów cytowanego dostawcy Kimi K3 został wydany na 22 lipca 2026.
Dostępne za pośrednictwem platformy programistycznej Kimi i wybranych dostawców, w tym OpenRouter i QwenCloud. Drogi dostępu wymienione w tym przewodniku to Moonshot AI, Kimi Platform i OpenRouter.
Dane wejściowe o wartości 3 USD · Dane wyjściowe o wartości 15 USD / 1 milion tokenów bezpośrednio. Moonshot podaje również 0,30 USD za milion buforowanych tokenów wejściowych. OpenRouter i inne hostowane trasy korzystają z różnych cen.
Dostępne za pośrednictwem platformy programistycznej Kimi i wybranych dostawców, w tym OpenRouter i QwenCloud. Bezpośrednia platforma Kimi działa zgodnie z opublikowanymi warunkami Moonshot; Obsługa regionu i kraju strony trzeciej zależy od wybranego dostawcy.
Warunki prywatności interfejsu API Moonshot i korzystania z modelu umożliwiają przechowywanie przesłanych treści i wykorzystywanie ich w celu świadczenia, utrzymywania, rozwijania i ulepszania usługi. Przed wysłaniem wrażliwych materiałów uzyskaj odpowiednie warunki korporacyjne. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
USD za milion tokenów dla podanych API przy standardowej długości kontekstu. Stawki cache i długiego kontekstu mogą się różnić. Pomijamy modele bez zgodnych, sprawdzonych cen; niższy koszt nie oznacza lepszej jakości.
Mistral AI
OpenAI
OpenAI
Anthropic
Mistral AI
OpenAI
OpenAI
Anthropic
Powiązane porównania
Najbardziej wydajny model OpenAI do trudnej, kompleksowej pracy, łączący rozumowanie pionierskie z oknem kontekstowym obejmującym milion tokenów i szerokim zestawem narzędzi agenta.
Otwórz pełne porównanieFlagowy ogólny model OpenAI do trudnego kodowania, analiz i pracy zawodowej, z bardzo dużym oknem kontekstowym i szerokim natywnym zestawem narzędzi.
Otwórz pełne porównanieFrontierowy model Anthropic do ambitnych, długotrwałych prac agentowych i programistycznych, z silną wizją i dostępnością na rynku korporacyjnym.
Otwórz pełne porównanieStabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash.
Otwórz pełne porównanieFrontierowy model tekstu i obrazu SpaceXAI do kodowania, zadań agentowych i pracy opartej na wiedzy, z narzędziami Direct Web, X i kodowaniem.
Otwórz pełne porównanieSpecjalistyczny model Groka, który wysyła kilku agentów AI równolegle do zbadania trudnego pytania, a następnie łączy ich pracę w jedną zbadaną odpowiedź.
Otwórz pełne porównanieDuży model z otwartymi ciężarami Thinking Machines Lab umożliwiający dostosowywanie procesów wnioskowania, kodowania, narzędzi, wizji i dźwięku.
Otwórz pełne porównanieModel frontierowy firmy Mistral o otwartej wadze, przeznaczony do wymagających przepływów pracy multimodalnych, kodowania, wnioskowania i agentów, z oknem kontekstowym o wielkości 256 tys.
Otwórz pełne porównanieTańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta.
Otwórz pełne porównanieFrontierowy model Alibaba Qwen do wnioskowania w długim kontekście, kodowania, narzędzi i rozumienia tekstu, obrazów i wideo.
Otwórz pełne porównanieMultimodalny model MiniMax z milionem tokenów do kodowania, agentów, korzystania z komputera i długich projektów w niskiej cenie bezpośredniego interfejsu API.
Otwórz pełne porównanieOtwarty model wnioskowania o długim kontekście Z.ai do kodowania, narzędzi i pracy agentowej w ramach tras hostowanych samodzielnie i zarządzanych.
Otwórz pełne porównanieKompaktowy, otwarty model wnioskowania TII do zadań tekstowych, długich kontekstów i samodzielnie hostowanych przepływów pracy z wywołaniami funkcji.
Otwórz pełne porównanieModel otwartych instrukcji TII 34B do wielojęzycznego tekstu, kodowania i kontrolowanych aplikacji hostowanych samodzielnie.
Otwórz pełne porównanieNajnowszy multimodalny model wnioskowania Meta dla długotrwałych agentów, kodowania, narzędzi i złożonej współpracy użytkowników.
Otwórz pełne porównanieModel języka dyfuzyjnego skoncentrowanego na agentach Celeris umożliwiający szybkie wnioskowanie, pętle narzędzi, działania strukturalne i integrację kompatybilną z OpenAI.
Otwórz pełne porównanieNajwiększy model wnioskowania Nemotron 3 firmy NVIDIA do obsługi złożonych agentów, kodowania, planowania, narzędzi, RAG i analizy milionów tokenów.
Otwórz pełne porównanieKompaktowy model NVIDIA 30B, będący mieszanką ekspertów, przeznaczony dla wydajnych agentów specjalistycznych i obiegów pracy z dużą ilością tekstów.
Otwórz pełne porównanieWydajny wielomodalny model Alibaba z milionem kontekstów do szybkich agentów, kodowania, pracy z dokumentami, wizji, rozumienia wideo i korzystania z narzędzi.
Otwórz pełne porównanieFlagowy model tekstu DeepSeek z milionem kontekstów do trudnego wnioskowania, kodowania, długotrwałych agentów, narzędzi i bardzo dużych wyników.
Otwórz pełne porównanieTańszy model V4 DeepSeek do dużych obciążeń związanych z wnioskowaniem, kodowaniem, agentami i milionami tokenów tekstowych.
Otwórz pełne porównanie