
Google a dévoilé une mise à jour de Veo 3.1, son modèle d’intelligence artificielle dédié à la création de vidéos. Cette nouvelle version permet de transformer des photographies en clips verticaux, prêts à être publiés sur des plateformes comme TikTok, Instagram ou YouTube Shorts.
Cette avancée est significative dans la stratégie de la société, qui vise à simplifier la création de contenu audiovisuel grâce à l’IA et à rivaliser dans un marché dominé par le format court et vertical.
La fonctionnalité est accessible via “Ingrédients à Vidéo”, un outil intégré dans l’écosystème de Veo. Cette fonctionnalité associe des images de référence à des instructions écrites pour générer automatiquement des vidéos. Avec cette mise à jour, Google a introduit pour la première fois la création native de vidéos au format 9:16, le standard des principales plateformes sociales, évitant ainsi les découpes, pertes de qualité ou adaptations forcées du contenu original.

Dans un communiqué officiel, Google a expliqué que cette amélioration permet de produire des narrations verticales d’haute qualité, conçues spécialement pour la consommation mobile. La société affirme que l’outil peut être utilisé tant pour du contenu décontracté que pour des projets plus ambitieux, sans nécessiter de compétences avancées en montage vidéo.
Jusqu’à présent, des plateformes comme CapCut proposaient déjà des intégrations avec des modèles de génération vidéo, mais ne permettaient pas de charger des images personnelles comme base pour créer des clips. Cette approche se voit désormais élargie avec cette mise à jour.
Outre le support des vidéos verticales, Veo 3.1 améliore également la cohérence visuelle. Google a précisé que le modèle préserve de manière plus consistente l’identité des personnes et des personnages lors de changements de décors, ainsi que la continuité des arrière-plans et objets. Le système ajuste automatiquement des paramètres comme l’éclairage, le ton et la silhouette pour s’assurer que les éléments demeurent harmonieusement intégrés dans une même séquence.

Un autre progrès remarquable est la capacité de synthèse visuelle. Cette fonction permet de combiner des images avec des styles, textures ou caractéristiques différentes dans une vidéo cohérente. Pour y parvenir, l’utilisateur doit définir dans les instructions textuelles quel style doit prédominer et comment les différents éléments visuels doivent être intégrés, élargissant ainsi les possibilités créatives.
Quant à la qualité, la mise à jour augmente également la résolution de sortie. Veo 3.1 est désormais capable de générer des vidéos en 1080p et 4K. Google a souligné que les clips en 1080p offrent une image plus nette et définie, tandis que les vidéos en 4K utilisent des techniques avancées d’échelle pour capturer les détails et textures, même dans des contenus de courte durée.
La nouvelle fonction de création de vidéos verticales à partir de photographies est disponible dès aujourd’hui dans l’application Gemini pour mobiles. Google a intégré “Ingrédients à Vidéo” directement dans l’application, permettant à un plus grand nombre d’utilisateurs d’expérimenter cette technologie sans dépendre d’outils externes.

Pour ceux qui recherchent des résolutions encore plus élevées ou un usage plus avancé, Google a ouvert l’accès via Flow, l’API de Gemini, Vertex AI et Google Vids. Ces options sont destinées aux créateurs professionnels, entreprises et développeurs cherchant à intégrer la génération vidéo par IA dans des flux de travail plus complexes.
En parallèle de ces nouveautés, la société a annoncé l’ajout d’une étiquette d’identification dans les vidéos générées avec Veo 3.1. Il s’agit de SynthID, une marque d’eau invisible à l’œil nu permettant de sentir le contenu créé par intelligence artificielle. L’objectif, selon Google, est de réduire la désinformation et d’offrir une plus grande transparence sur l’origine du matériel audiovisuel.
Les utilisateurs pourront vérifier si une vidéo a été générée par IA via l’application Gemini, une mesure destinée à soutenir les efforts de l’entreprise pour établir des normes de responsabilité dans l’utilisation des technologies génératives.
Points à retenir
- Veo 3.1 permet de créer des vidéos verticales à partir de photos, facilitant la création de contenu pour les réseaux sociaux.
- La fonction “Ingrédients à Vidéo” automatise la génération de vidéos, rendant la technologie plus accessible.
- La résolution des vidéos peut atteindre 4K, améliorant ainsi la qualité visuelle.
- SynthID permet d’identifier les vidéos générées par IA, promouvant la transparence.
- La mise à jour est intégrée à l’application Gemini, rendant la création vidéo plus accessible aux utilisateurs.
La nécessité croissante d’intégrer l’IA dans notre quotidien révèle des enjeux cruciaux. En promouvant la transparence, Google s’inscrit dans une démarche responsable à l’ère du numérique. Les avancées en matière de création de contenu interrogent alors notre vision sur la réalité elle-même. À mesure que les frontières entre ce qui est authentique et ce qui ne l’est pas s’amincissent, réévaluer notre relation avec la technologie devient essentiel. Nous devons envisager à quel point nous voulons que les machines influencent notre créativité et notre perception du monde.

