Gemini Embedding 2
Multimodalny model osadzania Google do umieszczania tekstu, obrazów, wideo, audio i plików PDF w jednej przeszukiwalnej przestrzeni wektorowej.
Multimodalny model osadzania Google do umieszczania tekstu, obrazów, wideo, audio i plików PDF w jednej przeszukiwalnej przestrzeni wektorowej.
Przegląd w prostym języku angielskim
Gemini Embedding 2 pozwala systemowi wyszukiwania porównywać znaczenie kilku typów multimediów zamiast utrzymywać oddzielny model wektorowy dla każdego formatu. Zapytanie tekstowe może pobrać odpowiedni obraz, segment wideo, klip audio, plik PDF lub fragment, jeśli są one osadzone w tym samym miejscu.
Programiści mogą wybrać mniejszy rozmiar wyjściowy, aby zmniejszyć ilość miejsca w bazie danych, lub zachować pełne 3072 wymiary, gdy ważniejsza jest jakość pobierania. Typy zadań pomagają odróżnić zapytania wyszukiwania od indeksowanych dokumentów, klasyfikacji, grupowania i innych obciążeń.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Ceny i porównania
Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.
Zakładamy 600 tokenów na stronę, przetwarzaną osobno. Faktyczna liczba się różni. Tylko embeddingi, bez przechowywania, wyszukiwania i odpowiedzi.
Gemini Embedding 2
Szacowany koszt (USD)
Dla podanego użycia · USD · Cena API, nie abonamentu
Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.
Dostęp do API i dostawcy
Dostępność
Ogólnie dostępne za pośrednictwem interfejsu API programisty Gemini dla osadzania tekstu i multimodalnego.
Dostęp Gemini API jest zgodny z listą obsługiwanych krajów Google, stanem rozliczeń projektu i wymaganiami wiekowymi.
Sprawdź dostępność na żywoDane i szkolenia
Warunki Google Gemini API rozróżniają usługi bezpłatne i płatne: treści z usług bezpłatnych mogą być wykorzystywane do ulepszania produktów, natomiast monity i odpowiedzi dotyczące usług płatnych nie są wykorzystywane do ulepszania produktów.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Multimodalny model osadzania Google do umieszczania tekstu, obrazów, wideo, audio i plików PDF w jednej przeszukiwalnej przestrzeni wektorowej. Gemini Embedding 2 pozwala systemowi wyszukiwania porównywać znaczenie kilku typów multimediów zamiast utrzymywać oddzielny model wektorowy dla każdego formatu. Zapytanie tekstowe może pobrać odpowiedni obraz, segment wideo, klip audio, plik PDF lub fragment, jeśli są one osadzone w tym samym miejscu.
Według materiałów cytowanego dostawcy Gemini Embedding 2 został wydany na 22 kwietnia 2026.
Ogólnie dostępne za pośrednictwem interfejsu API programisty Gemini dla osadzania tekstu i multimodalnego. Drogi dostępu wymienione w tym przewodniku to Google i Google AI Studio.
Wyślij SMS o wartości 0,20 $ / 1 milion. Płatne standardowe ceny obejmują również osobne wejście obrazu, dźwięku i wideo. Stawki grupowe stanowią połowę standardowych stawek płaconych; Warstwa bezpłatna ma inne warunki korzystania z danych.
Ogólnie dostępne za pośrednictwem interfejsu API programisty Gemini dla osadzania tekstu i multimodalnego. Dostęp Gemini API jest zgodny z listą obsługiwanych krajów Google, stanem rozliczeń projektu i wymaganiami wiekowymi.
Warunki Google Gemini API rozróżniają usługi bezpłatne i płatne: treści z usług bezpłatnych mogą być wykorzystywane do ulepszania produktów, natomiast monity i odpowiedzi dotyczące usług płatnych nie są wykorzystywane do ulepszania produktów. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
USD za milion tokenów dla podanych API przy standardowej długości kontekstu. Stawki cache i długiego kontekstu mogą się różnić. Pomijamy modele bez zgodnych, sprawdzonych cen; niższy koszt nie oznacza lepszej jakości.
Mistral AI
Voyage AI
Voyage AI
Voyage AI
OpenAI
Ten model
Powiązane porównania
Model OpenAI o najwyższych możliwościach osadzania tekstu na potrzeby wyszukiwania semantycznego, rekomendacji, grupowania i potoków wyszukiwania.
Otwórz pełne porównanieCohere to korporacyjny model osadzania wielojęzycznego tekstu, obrazów i bogatych wizualnie dokumentów z oknem kontekstowym o wielkości 128 KB.
Otwórz pełne porównanieWysokiej jakości ogólny model osadzania Voyage AI do wyszukiwania tekstu i kodu, z regulowanymi wymiarami i współdzieloną przestrzenią wektorową rodziny.
Otwórz pełne porównanieModel osadzania uwzględniający dokumenty Voyage AI, który automatycznie tworzy wektory dla fragmentów, zachowując jednocześnie informacje z otaczającego dokumentu.
Otwórz pełne porównanieSpecjalistyczny model osadzania Voyage AI umożliwiający wyszukiwanie odpowiedniego kodu na podstawie pytań w języku naturalnym lub innego kontekstu kodu źródłowego.
Otwórz pełne porównanieProsty model osadzania hostowanego tekstu firmy Mistral do wyszukiwania semantycznego, grupowania, klasyfikacji i RAG.
Otwórz pełne porównanie