Alle Modelle

KI-Modellunternehmen

Google KI-Modelle

Google entwickelt die Gemini-Familie zusammen mit den speziellen Medien-, Dokumenten-, Sprach- und Weltmodellen von Google DeepMind und Google Cloud weiter. Der Zugriff variiert zwischen den Produkten Gemini API, Vertex AI, Google Cloud und den Forschungsvorschauen.

11-Modelle9 ModellkategorienOffizielle Website

Über Google

Modelle ab Google

Das stabile, hocheffiziente multimodale Modell von Google für Agenten, Softwarearbeit und große Mixed-Media-Eingaben zum Einführungspreis der Flash-Stufe.

0,75 $ Input · 3,75 $ Output / 1 Mio. Token

Leitfaden lesen

Googles vielseitiges Bild-Arbeitspferd für schnelle Generierung, Konversationsbearbeitung, mehrere Referenzen, fundierte Bilder und Ausgaben bis zu 4K.

0,067 $ / 1K Bild

Leitfaden lesen

Das Vorschauvideomodell von Google für die text-, bild- und videogeführte Generierung mit nativem Audio und Ausgabeoptionen bis zu 4K.

0,40 $/Sekunde bei 720p oder 1080p

Leitfaden lesen

Die kostengünstigere Veo 3.1-Variante von Google für die schnelle Erstellung kurzer Videoclips mit nativem Audio und Ausgabeoptionen bis zu 4K.

0,10 $–0,30 $/generierte Sekunde

Leitfaden lesen

Das Flaggschiff-Musikmodell von Google für komplette High-Fidelity-Songs mit reichhaltigeren Arrangements, ausdrucksstarkem Gesang, strukturierten Texten und detaillierter kreativer Kontrolle.

0,08 $/vollständiger Song

Leitfaden lesen

Das Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.

0,005 $/Min. Audioeingang · 0,018 $/Min. Audioausgang

Leitfaden lesen

Das Forschungsweltmodell von Google DeepMind zur Generierung fotorealistischer, steuerbarer Umgebungen, die anhand einer Textbeschreibung in Echtzeit erkundet werden können.

Nicht veröffentlicht

Leitfaden lesen

Das multimodale Einbettungsmodell von Google zum Platzieren von Text, Bildern, Video, Audio und PDFs in einem durchsuchbaren Vektorraum.

Senden Sie eine SMS mit 0,20 $ / 1 Mio. Token

Leitfaden lesen

Das allgemeine Sprach-zu-Text-Modell von Google Cloud für Streaming, Datei und kostengünstige dynamische Batch-Transkription in vielen Sprachen und Regionen.

0,016 $/Min. Standard · 0,003 $/Min. dynamischer Batch

Leitfaden lesen