Wszystkie modele
Google Cloud

Google Gemini Layout Parser 1.6

Analizator składni Google Cloud wspomagany przez Gemini do zachowywania hierarchii dokumentów i tworzenia fragmentów bogatych w kontekst na potrzeby wyszukiwania korporacyjnego i RAG.

Przegląd w prostym języku angielskim

Czym właściwie jest Google Gemini Layout Parser 1.6

Gemini Layout Parser 1.6 łączy Google OCR z Gemini 3.0 Flash. Identyfikuje nagłówki, akapity, listy, tabele, rysunki, nagłówki i stopki, a następnie tworzy drzewo dokumentu, dzięki czemu pobrany fragment może zachować kontekst sekcji, z której pochodzi.

Jest to usługa analizowania i fragmentowania, a nie ogólny model czatu. Jest to szczególnie przydatne, gdy płaski OCR oddziela tabelę od jej nagłówków lub akapit od sekcji nadrzędnej.

Dobre dopasowanie do

  • RAG w sprawie raportów, instrukcji i dokumentów
  • Fragmenty uwzględniające układ z dziedziczonymi nagłówkami
  • Mieszane przetwarzanie plików PDF, prezentacji, dokumentów i arkuszy kalkulacyjnych

Porównanie kategorii

Fakty, które mają znaczenie w przypadku modeli dokumenty

Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.

Cena za stronę
Strony o wartości 10 USD / 1 tys., w tym początkowe porcjeAktualna stawka dostawcy i dokładna strona lub jednostka adnotacji, którą obejmuje.
Akceptowane dokumenty
PDF, HTML, DOCX, PPTX, XLSX, XLSMTypy plików i dokumentów, które ma przetwarzać wymieniony punkt końcowy.
Co otrzymasz z powrotem
Hierarchia DocumentLayout, fragmenty kontekstowe, opisy tabel/rysunkówMarkdown, tabele, fragmenty, pola, opisy lub inny wynik do odczytu maszynowego.
Układ i pewność
Nagłówki, tabele, rysunki, listy, nagłówki i stopki oparte na technologii OCROkreśla, czy dane wyjściowe zachowują pola, hierarchię, etykiety, kolejność odczytu lub informacje o poufności.
Zasięg językowy
Nie wymienione dla tej wersjiObsługa języków udokumentowana przez dostawcę bez wnioskowania o językach niewymienionych na liście.
Gdzie biegnie
Google Cloud Dokument AI; globalny punkt końcowy GeminiBezpośredni interfejs API, usługa wsadowa, środowisko prywatne, rynek lub regionalna trasa w chmurze.

Ceny i porównania

Oszacuj koszt

Podaj zużycie. Szacunek aktualizuje się podczas wpisywania.

Liczymy strony, nie pliki. PDF z 10 stronami to 10 stron. Szacunek korzysta z dostępnej stawki przetwarzania danego modelu.

Google Gemini Layout Parser 1.6

Google Cloud

Szacowany koszt (USD)

0,10 USD

Dla podanego użycia · USD · Cena API, nie abonamentu

Jak działa ten szacunek

Szacunki nie obejmują podatków, narzędzi, zapisu i przechowywania pamięci podręcznej, darmowych limitów ani rabatów. Dla obrazów obejmują tylko wynik, bez promptu i obrazów referencyjnych. Tryby jakości różnią się. Brak stawki nie oznacza bezpłatności.

Dostęp do API i dostawcy

Gdzie zdobyć Google Gemini Layout Parser 1.6

Dostępność

Regiony i etap dostępu

Dostęp kandydata do wydania poprzez dokument AI Google Cloud.

Ta wersja korzysta z globalnego punktu końcowego Vertex AI Gemini i wyraźnie nie jest zgodna ze standardem przechowywania danych Google, nawet jeśli jest wywoływana za pośrednictwem punktów końcowych w USA lub UE.

Sprawdź dostępność na żywo

Dane i szkolenia

Trasa ma znaczenie.

Google twierdzi, że dokumenty i prognozy klientów Document AI nie są wykorzystywane do uczenia modeli. Dokumenty online są przetwarzane w pamięci bez trwałości dysku; Wejścia wsadowe mają bezpieczne przechowywanie przez maksymalnie jeden dzień.

Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.

Przeczytaj politykę dostawcy

Często zadawane pytania

Często zadawane pytania dotyczące Google Gemini Layout Parser 1.6

Co to jest Google Gemini Layout Parser 1.6?

Analizator składni Google Cloud wspomagany przez Gemini do zachowywania hierarchii dokumentów i tworzenia fragmentów bogatych w kontekst na potrzeby wyszukiwania korporacyjnego i RAG. Gemini Layout Parser 1.6 łączy Google OCR z Gemini 3.0 Flash. Identyfikuje nagłówki, akapity, listy, tabele, rysunki, nagłówki i stopki, a następnie tworzy drzewo dokumentu, dzięki czemu pobrany fragment może zachować kontekst sekcji, z której pochodzi.

Kiedy wypuszczono Google Gemini Layout Parser 1.6?

Według materiałów cytowanego dostawcy Google Gemini Layout Parser 1.6 został wydany na 13 stycznia 2026.

Gdzie mogę uzyskać dostęp do Google Gemini Layout Parser 1.6?

Dostęp kandydata do wydania poprzez dokument AI Google Cloud. Drogi dostępu wymienione w tym przewodniku to Google Cloud.

Ile kosztuje Google Gemini Layout Parser 1.6?

10 dolarów za 1000 stron. Cena analizatora układu Google Cloud obejmuje początkowe porcje. Ponowne porcjowanie jest rozliczane osobno.

Gdzie jest dostępny Google Gemini Layout Parser 1.6?

Dostęp kandydata do wydania poprzez dokument AI Google Cloud. Ta wersja korzysta z globalnego punktu końcowego Vertex AI Gemini i wyraźnie nie jest zgodna ze standardem przechowywania danych Google, nawet jeśli jest wywoływana za pośrednictwem punktów końcowych w USA lub UE.

Czy moje dane API Google Gemini Layout Parser 1.6 są wykorzystywane do szkolenia?

Google twierdzi, że dokumenty i prognozy klientów Document AI nie są wykorzystywane do uczenia modeli. Dokumenty online są przetwarzane w pamięci bez trwałości dysku; Wejścia wsadowe mają bezpieczne przechowywanie przez maksymalnie jeden dzień. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.