Google $GOOGL facilite la création de vidéos courtes avec l'IA. À partir de cette semaine, les abonnés à ses plans Gemini AI Ultra et Pro peuvent transformer des photos en clips vidéo de huit secondes directement via l'interface de chat Gemini.
Les utilisateurs payants du chatbot de Google peuvent désormais lui demander de convertir des photos et du texte en clips vidéo de 8 secondes avec du son.

Thomas Fuller/SOPA Images/LightRocket via Getty Images
Google $GOOGL facilite la création de vidéos courtes avec l'IA. À partir de cette semaine, les abonnés à ses plans Gemini AI Ultra et Pro peuvent transformer des photos en clips vidéo de huit secondes directement via l'interface de chat Gemini.
La fonctionnalité, qui est d'abord déployée sur la version Web de Gemini puis sur l'application mobile plus tard cette semaine, permet aux utilisateurs de télécharger une photo et d'ajouter une description textuelle pour générer une courte vidéo avec son. Les vidéos sortent sous forme de fichiers MP4 au format paysage 720p.
Cet outil n'est pas tout à fait nouveau — Google l'a présenté en mai dernier lors de sa conférence annuelle des développeurs dans le cadre de Veo 3, son dernier modèle de génération vidéo. Jusqu'à présent, il n'était disponible que via Flow, l'outil de création cinématographique autonome de Google, mais maintenant il est intégré à Gemini, ce qui le rend plus accessible aux abonnés.
La mise à jour intervient alors que Google tente de rattraper des concurrents comme OpenAI et Runway, ainsi que les géants technologiques chinois Alibaba et Kuaishou, tous en course pour lancer leurs propres outils vidéo IA.
Google affirme avoir des directives strictes pour prévenir les abus. Par exemple, Google dit qu'il est interdit de créer des vidéos à l'aide d'images de célébrités, de politiciens ou d'autres personnalités publiques, et qu'il ne produira pas de contenu faisant la promotion de la violence ou de l'intimidation.
Cela dit, l'outil est loin d'être parfait. Tests par Bloomberg ont constaté que lorsque les utilisateurs essayaient de créer des vidéos parlantes à partir de photos, l'IA modifiait parfois les visages des gens ou même changeait leur race. Des instructions plus simples — comme faire osciller une plante dans le vent ou animer un chat pour qu'il ait l'air de parler — fonctionnaient bien mieux. Mais lorsqu'on lui a demandé de faire un breakdance, il s'est contenté de leur faire signe de la main devant la caméra.
Un porte-parole de Google a déclaré à Bloomberg que l'IA n'était pas programmée pour changer l'apparence de quelqu'un et que la technologie est encore en développement. Pour le moment, elle fonctionne mieux pour animer des scènes de nature, des dessins et des objets, mais des améliorations pour les animations de visage sont à venir dans de futures mises à jour.
Rejoignez plus de 500 000 lecteurs qui commencent leur journée avec Quartz.
En vous abonnant, vous acceptez nos Conditions d'utilisation et notre Politique de confidentialité.