Google Vids transforme un selfie en présentateur automatisé
— AUDIOVISUEL
Google Vids intègre Gemini Omni et des avatars vocaux pour générer des vidéos sans montage manuel. Un selfie, un extrait audio suffisent désormais à produire un output vidéo complet. Cette automation du workflow de post-production redessine les contraintes de production pour les équipes créatives.

Plus de caméra, plus de studio, plus même besoin de se montrer. Un selfie suffit. Un court extrait vocal aussi. Google Vids fabrique désormais un double numérique qui récite à l'écran les textes qu'on lui confie.
Le principe tient en quelques gestes. L'outil capte un visage, une voix, puis reconstitue les deux. On tape ce que l'on veut faire dire — l'avatar le prononce, sans qu'aucune prise de vue n'ait été tournée. En coulisses, Gemini Omni génère et retouche les clips à partir de simples descriptions écrites.
L'édition, elle, change de logique. Le fond, l'éclairage, les effets se corrigent en dialoguant avec la machine. On décrit, elle ajuste, on itère. Aucun retour à la case départ à chaque modification.
Le service ne s'ouvre pas à tout le monde. Il vise les abonnés Google AI Pro et Ultra, ainsi que les clients Workspace business. Les avatars restent cantonnés à certaines régions, réservés aux personnes majeures, et chaque double demeure rattaché au compte Google et à l'apparence de son propriétaire. Google avait déjà élargi Veo 3.1 à l'ensemble des utilisateurs de Vids en février.
Reste la question de la preuve. Chaque vidéo produite embarque un filigrane SynthID, invisible mais destiné à signaler l'origine artificielle du contenu. Un garde-fou technique face à une bascule qui s'installe : distinguer un collaborateur filmé d'un avatar récitant son script tiendra bientôt du pari.