Cara-4
Modèle de personne numérique expressif en temps réel de Anam pour les conversations en direct avec des avatars basés sur des images, la direction des émotions et des composants d'IA à emporter.
Modèle de personne numérique expressif en temps réel de Anam pour les conversations en direct avec des avatars basés sur des images, la direction des émotions et des composants d'IA à emporter.
Présentation de l'anglais simple
Cara-4 génère une performance visuelle en direct plutôt que d'attendre le rendu d'une vidéo complète. Les équipes peuvent partir d'identités réalistes, 3D ou illustrées, s'exprimer directement avec des notes en langage naturel et utiliser la pile Anam ou apporter l'audio de leur propre langage et système vocal.
Anam publie les formats de sortie portrait et paysage ainsi que la latence de l'avatar côté serveur, ce qui facilite la planification de l'interface. Un déploiement réel nécessite toujours des tests de bout en bout pour le tour de rôle, le temps de connexion, les performances des appareils et la latence de chaque service d'IA connecté.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Accès API et fournisseur
Disponibilité
Disponible dans l'API et le Lab de Anam, avec des intégrations pour les applications Web et les principaux produits de visioconférence.
Anam documente les contrôles de service et d'entreprise, mais ne fournit pas de liste exhaustive de pays spécifiques au modèle sur la page de lancement.
Vérifier la disponibilité en directDonnées et formation
Anam indique que le contenu de la session client n'est pas utilisé pour la formation, sauf accord séparé. Les enregistrements par défaut peuvent être conservés jusqu'à 30 jours, tandis que la conservation sans données d'entreprise est disponible ; vérifiez les paramètres exacts de l’espace de travail.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
Modèle de personne numérique expressif en temps réel de Anam pour les conversations en direct avec des avatars basés sur des images, la direction des émotions et des composants d'IA à emporter. Cara-4 génère une performance visuelle en direct plutôt que d'attendre le rendu d'une vidéo complète. Les équipes peuvent partir d'identités réalistes, 3D ou illustrées, s'exprimer directement avec des notes en langage naturel et utiliser la pile Anam ou apporter l'audio de leur propre langage et système vocal.
Cara-4 a été publié sur 14 juillet 2026 selon les documents du fournisseur cités.
Disponible dans l'API et le Lab de Anam, avec des intégrations pour les applications Web et les principaux produits de visioconférence. Les voies d'accès répertoriées dans ce guide sont Anam.
30 minutes gratuites ; excédents payés d'environ 0,11 $ à 0,16 $/min. Le tarif effectif dépend du forfait Anam et des minutes incluses. La capacité d’entreprise et les contrôles de rétention zéro sont négociés séparément.
Disponible dans l'API et le Lab de Anam, avec des intégrations pour les applications Web et les principaux produits de visioconférence. Anam documente les contrôles de service et d'entreprise, mais ne fournit pas de liste exhaustive de pays spécifiques au modèle sur la page de lancement.
Anam indique que le contenu de la session client n'est pas utilisé pour la formation, sauf accord séparé. Les enregistrements par défaut peuvent être conservés jusqu'à 30 jours, tandis que la conservation sans données d'entreprise est disponible ; vérifiez les paramètres exacts de l’espace de travail. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
Comparaisons associées
Un modèle d'avatar en temps réel qui peut animer une personne, une illustration ou un personnage non humain à partir d'une image et se connecter à une pile d'agents vocaux existante.
Ouvrir la comparaison complèteModèle d'avatar rendu de HeyGen pour produire des vidéos de présentateur raffinées à partir d'un court enregistrement d'identité, d'un script ou d'un fichier audio fourni.
Ouvrir la comparaison complèteModèle de personnage audio de Hedra pour créer des vidéos parlantes à partir d'une image, d'un à quatre haut-parleurs et d'une direction de performance en option.
Ouvrir la comparaison complèteModèle d'avatar vidéo professionnel de Synthesia pour la parole, les gestes, les mouvements corporels et le contenu de présentateur multilingue prenant en compte les scripts dans un éditeur complet.
Ouvrir la comparaison complète