Genie 3
Modèle mondial de recherche Google DeepMind pour générer des environnements photoréalistes et contrôlables qui peuvent être explorés en temps réel à partir d'une description textuelle.
Modèle mondial de recherche Google DeepMind pour générer des environnements photoréalistes et contrôlables qui peuvent être explorés en temps réel à partir d'une description textuelle.
Présentation de l'anglais simple
Genie 3 génère un monde visuel au fur et à mesure que l'utilisateur s'y déplace plutôt que de restituer une vidéo fixe à l'avance. DeepMind rapporte une sortie 720p, 20 à 24 images par seconde et une cohérence sur quelques minutes d'interaction.
Il est mieux compris comme un produit de recherche et expérimental important, et non comme une API mondiale instantanée. L'accès se fait via Project Genie et n'est pas accompagné d'un prix d'API public ni d'un contrat d'intégration général.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Accès API et fournisseur
Disponibilité
Accès à la recherche/à l'expérimentation via Project Genie ; aucune API générale de développeur n'est documentée.
L'éligibilité du projet et la disponibilité des pays peuvent changer et ne sont pas énumérées sur la page du modèle.
Vérifier la disponibilité en directDonnées et formation
Aucune politique générale relative aux données de l'API des développeurs n'est publiée pour cette entrée d'accès à la recherche. Consultez les conditions de Project Genie avant de télécharger des invites confidentielles ou des documents de référence.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
Modèle mondial de recherche Google DeepMind pour générer des environnements photoréalistes et contrôlables qui peuvent être explorés en temps réel à partir d'une description textuelle. Genie 3 génère un monde visuel au fur et à mesure que l'utilisateur s'y déplace plutôt que de restituer une vidéo fixe à l'avance. DeepMind rapporte une sortie 720p, 20 à 24 images par seconde et une cohérence sur quelques minutes d'interaction.
Genie 3 a été publié sur 5 août 2025 selon les documents du fournisseur cités.
Accès à la recherche/à l'expérimentation via Project Genie ; aucune API générale de développeur n'est documentée. Les voies d'accès répertoriées dans ce guide sont Google DeepMind.
Non publié. Genie 3 est présenté via Project Genie plutôt que via une API de développeur mesurée généralement disponible.
Accès à la recherche/à l'expérimentation via Project Genie ; aucune API générale de développeur n'est documentée. L'éligibilité du projet et la disponibilité des pays peuvent changer et ne sont pas énumérées sur la page du modèle.
Aucune politique générale relative aux données de l'API des développeurs n'est publiée pour cette entrée d'accès à la recherche. Consultez les conditions de Project Genie avant de télécharger des invites confidentielles ou des documents de référence. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
Comparaisons associées
Modèle d'API public de World Labs pour transformer du texte, des images, des panoramas, des ensembles multi-vues ou des vidéos en grands mondes 3D explorables et en ressources spatiales.
Ouvrir la comparaison complèteLe modèle mondial conditionné par l'action de Decart pour l'entraînement physique à l'IA, générant des vues de simulation synchronisées et contrôlables en temps réel.
Ouvrir la comparaison complèteLe plus grand modèle mondial général de Odyssey, axé sur la simulation de l'état suivant en temps réel, la précision physique, les futurs ouverts et les déploiements interactifs plus longs.
Ouvrir la comparaison complèteSurface de caractères conversationnels publics du modèle mondial général de Runway, créant des personnages visuels en temps réel à partir d'une image de référence.
Ouvrir la comparaison complète