Gemini 3.8 Flash
Stabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash.
Stabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash.
Przegląd w prostym języku angielskim
Gemini 3.8 Flash łączy okno wejściowe zawierające milion tokenów z obsługą tekstu, obrazu, wideo, audio i plików PDF. Jego natywne funkcje API obejmują wywoływanie funkcji, wykonywanie kodu, podstawy wyszukiwania, wyszukiwanie plików i strukturalne wyjście.
Obecna cena jest promocyjna. Zespoły porównujące roczne koszty powinny modelować zarówno stawkę wprowadzającą, jak i opublikowaną wyższą stawkę, która zacznie obowiązywać w 2027 r., a także wszelkie rozmowy w sprawie poszukiwań lub uziemienia.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Przykład: 6000 tokenów wejścia dla 10 stron i 500 na podsumowanie. Długość stron bywa różna; dostosuj wartości.
Jedno wykonanie wysyła dane do modelu i odbiera odpowiedź. Tokeny to fragmenty tekstu: wejście to treść wysłana, a wyjście to otrzymana odpowiedź.
Gemini 3.8 Flash
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Dostępne za pośrednictwem Gemini API i Google AI Studio w obsługiwanych regionach, z dostępnymi również trasami Vertex i Gateway.
Skorzystaj z aktualnej listy dostępnych regionów Google i sprawdź ograniczenia funkcji dla wybranej trasy.
Sprawdź dostępność na żywoDane i szkolenia
Google twierdzi, że płatne monity i odpowiedzi Gemini API nie są wykorzystywane do ulepszania produktów. Zasadniczo można korzystać z treści objętych usługą bezpłatną, przy czym użytkownicy z EOG, Wielkiej Brytanii i Szwajcarii są różnie traktowani; sprawdź aktualne warunki dla swojego konta i regionu.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Stabilny, wysokowydajny model multimodalny Google do zastosowań agentów, pracy z oprogramowaniem i dużych danych wejściowych z różnych multimediów w początkowej cenie warstwy Flash. Gemini 3.8 Flash łączy okno wejściowe zawierające milion tokenów z obsługą tekstu, obrazu, wideo, audio i plików PDF. Jego natywne funkcje API obejmują wywoływanie funkcji, wykonywanie kodu, podstawy wyszukiwania, wyszukiwanie plików i strukturalne wyjście.
Według materiałów cytowanego dostawcy Gemini 3.8 Flash został wydany na 2 września 2026.
Dostępne za pośrednictwem Gemini API i Google AI Studio w obsługiwanych regionach, z dostępnymi również trasami Vertex i Gateway. Drogi dostępu wymienione w tym przewodniku to Google i OpenRouter.
Wejście 0,75 USD · Wyjście 3,75 USD / 1 milion tokenów. Wstępna cena płatnego poziomu obowiązująca do 31 grudnia 2026 r.; Google podaje kwotę wejściową wynoszącą 1,50 USD i kwotę wyjściową 7,50 USD od 1 stycznia 2027 r.
Dostępne za pośrednictwem Gemini API i Google AI Studio w obsługiwanych regionach, z dostępnymi również trasami Vertex i Gateway. Skorzystaj z aktualnej listy dostępnych regionów Google i sprawdź ograniczenia funkcji dla wybranej trasy.
Google twierdzi, że płatne monity i odpowiedzi Gemini API nie są wykorzystywane do ulepszania produktów. Zasadniczo można korzystać z treści objętych usługą bezpłatną, przy czym użytkownicy z EOG, Wielkiej Brytanii i Szwajcarii są różnie traktowani; sprawdź aktualne warunki dla swojego konta i regionu. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
USD za milion tokenów dla podanych API przy standardowej długości kontekstu. Stawki cache i długiego kontekstu mogą się różnić. Pomijamy modele bez zgodnych, sprawdzonych cen; niższy koszt nie oznacza lepszej jakości.
Mistral AI
Ten model
OpenAI
OpenAI
Anthropic
Mistral AI
Ten model
OpenAI
OpenAI
Anthropic
Powiązane porównania
Najbardziej wydajny model OpenAI do trudnej, kompleksowej pracy, łączący rozumowanie pionierskie z oknem kontekstowym obejmującym milion tokenów i szerokim zestawem narzędzi agenta.
Otwórz pełne porównanieFlagowy ogólny model OpenAI do trudnego kodowania, analiz i pracy zawodowej, z bardzo dużym oknem kontekstowym i szerokim natywnym zestawem narzędzi.
Otwórz pełne porównanieFrontierowy model Anthropic do ambitnych, długotrwałych prac agentowych i programistycznych, z silną wizją i dostępnością na rynku korporacyjnym.
Otwórz pełne porównanieFrontierowy model tekstu i obrazu SpaceXAI do kodowania, zadań agentowych i pracy opartej na wiedzy, z narzędziami Direct Web, X i kodowaniem.
Otwórz pełne porównanieSpecjalistyczny model Groka, który wysyła kilku agentów AI równolegle do zbadania trudnego pytania, a następnie łączy ich pracę w jedną zbadaną odpowiedź.
Otwórz pełne porównanieDuży model z otwartymi ciężarami Thinking Machines Lab umożliwiający dostosowywanie procesów wnioskowania, kodowania, narzędzi, wizji i dźwięku.
Otwórz pełne porównanieModel frontierowy firmy Mistral o otwartej wadze, przeznaczony do wymagających przepływów pracy multimodalnych, kodowania, wnioskowania i agentów, z oknem kontekstowym o wielkości 256 tys.
Otwórz pełne porównanieTańszy, otwarty model Mistral, który łączy w jednym punkcie końcowym normalne wykonywanie instrukcji, rozumowanie, kodowanie, wizję i narzędzia agenta.
Otwórz pełne porównanieFrontierowy model Alibaba Qwen do wnioskowania w długim kontekście, kodowania, narzędzi i rozumienia tekstu, obrazów i wideo.
Otwórz pełne porównanieMultimodalny model MiniMax z milionem tokenów do kodowania, agentów, korzystania z komputera i długich projektów w niskiej cenie bezpośredniego interfejsu API.
Otwórz pełne porównanieOtwarty model wnioskowania o długim kontekście Z.ai do kodowania, narzędzi i pracy agentowej w ramach tras hostowanych samodzielnie i zarządzanych.
Otwórz pełne porównanieFrontierowy model multimodalny Moonshot AI do kodowania milionów tokenów, wnioskowania, pracy opartej na wiedzy i agentów opartych na narzędziach.
Otwórz pełne porównanieKompaktowy, otwarty model wnioskowania TII do zadań tekstowych, długich kontekstów i samodzielnie hostowanych przepływów pracy z wywołaniami funkcji.
Otwórz pełne porównanieModel otwartych instrukcji TII 34B do wielojęzycznego tekstu, kodowania i kontrolowanych aplikacji hostowanych samodzielnie.
Otwórz pełne porównanieNajnowszy multimodalny model wnioskowania Meta dla długotrwałych agentów, kodowania, narzędzi i złożonej współpracy użytkowników.
Otwórz pełne porównanieModel języka dyfuzyjnego skoncentrowanego na agentach Celeris umożliwiający szybkie wnioskowanie, pętle narzędzi, działania strukturalne i integrację kompatybilną z OpenAI.
Otwórz pełne porównanieNajwiększy model wnioskowania Nemotron 3 firmy NVIDIA do obsługi złożonych agentów, kodowania, planowania, narzędzi, RAG i analizy milionów tokenów.
Otwórz pełne porównanieKompaktowy model NVIDIA 30B, będący mieszanką ekspertów, przeznaczony dla wydajnych agentów specjalistycznych i obiegów pracy z dużą ilością tekstów.
Otwórz pełne porównanieWydajny wielomodalny model Alibaba z milionem kontekstów do szybkich agentów, kodowania, pracy z dokumentami, wizji, rozumienia wideo i korzystania z narzędzi.
Otwórz pełne porównanieFlagowy model tekstu DeepSeek z milionem kontekstów do trudnego wnioskowania, kodowania, długotrwałych agentów, narzędzi i bardzo dużych wyników.
Otwórz pełne porównanieTańszy model V4 DeepSeek do dużych obciążeń związanych z wnioskowaniem, kodowaniem, agentami i milionami tokenów tekstowych.
Otwórz pełne porównanie