Opinions et analyses

Un jumeau numérique parle en mon nom : l’expérience de Synthesia soulève des questions de confiance dans les médias

Une journaliste de TechCrunch a testé la création, via Synthesia, d’une version numérique interactive d’elle-même, entraînée sur un seul article et capable d’y répondre à l’oral et en vidéo. L’expérience révèle le potentiel du jumeau numérique, mais soulève des questions plus profondes sur la confiance et les limites de son utilisation dans le journalisme et le travail institutionnel.

2026-09-26
5 min de lecture
2 vues
certi.news Editorial Team
Un jumeau numérique parle en mon nom : l’expérience de Synthesia soulève des questions de confiance dans les médias

L’entreprise Synthesia a créé une version numérique interactive de la journaliste de TechCrunch Dominic-Madori Davis, après avoir pris plusieurs photos d’elle et enregistré deux minutes de sa voix. Le résultat n’était pas une simple image récitant un texte écrit, mais un Avatar qui écoute les questions et les convertit en texte, puis utilise un modèle linguistique pour formuler la réponse, transforme cette réponse en voix, tandis qu’un modèle vidéo anime les traits du personnage pendant qu’il parle.

La journaliste a choisi d’entraîner la version interactive sur un article qu’elle avait écrit au sujet des raisons de l’augmentation des cas de fraude dans les startups financées par du capital-risque par rapport à celles qui ne le sont pas. Le jumeau était donc « déterministe » : il ne répond que dans le cadre pour lequel il a été préparé et redirige les questions qui en sortent vers l’article original.

Comment le jumeau numérique a-t-il été construit ?

L’équipe de Synthesia a eu besoin de quelques jours pour créer les modèles. La journaliste a obtenu des versions personnelles qui lisent les textes qu’elle leur fournit, ainsi que des versions interactives capables d’écouter et de répondre, avec des options avec ou sans lunettes. Le système utilise les modèles vidéo et audio de Synthesia, tout en permettant de choisir d’autres modèles de Cartesia, ElevenLabs, Google et OpenAI, ainsi que des options pour héberger le jumeau sur le cloud choisi par le client ou chez Synthesia.

L’entreprise répartit ces capacités en trois grandes catégories : une plateforme de création et de diffusion vidéo utilisant des Avatars traditionnels, la plateforme interactive Sessions destinée aux sondages et aux exercices de simulation, et une interface API permettant d’intégrer des modèles audio et vidéo à d’autres services afin de créer des Avatars interactifs ou différents produits.

Que révèle l’expérience ?

La journaliste a constaté que la voix était proche de la sienne dans la version personnelle, mais ses amis ont estimé que la ressemblance était moins convaincante dans la version interactive. Malgré cela, la présence était suffisante pour produire un sentiment d’étrangeté, au point que ses parents ont essayé de poser des questions personnelles dont seuls les membres de la famille connaissent les réponses, sans obtenir de réponse en raison des restrictions imposées par l’entraînement.

Ce résultat met en évidence une différence importante entre un Avatar au périmètre contrôlé et une version alimentée par un modèle conversationnel ouvert. Le premier est relativement prévisible, mais son utilité est limitée en dehors du contenu sur lequel il a été entraîné. Le second peut sembler plus flexible, mais il ouvre la voie à des réponses inventées ou à des comportements difficiles à contrôler.

Pourquoi cette information est-elle importante ?

Selon l’autrice, la question de l’utilisation potentielle dans le journalisme est la plus importante : le public acceptera-t-il que l’information soit présentée par une personnalité numérique ? Un Avatar peut-il remplacer un journaliste ou permettre aux directeurs généraux de s’adresser à une version numérique du journaliste plutôt qu’à la personne elle-même ? Sa position est claire sur un point essentiel : le cœur du journalisme est la confiance, et elle ne pense pas que cet élément puisse être facilement délégué à l’intelligence artificielle.

En dehors des médias, l’idée pourrait être plus attrayante pour les entreprises et les particuliers ; une version numérique pourrait répondre aux questions en l’absence de son propriétaire ou contribuer à la formation ainsi qu’aux services destinés aux employés et aux clients. Mais l’expérience ne prouve pas que ces modèles soient prêts à remplacer les êtres humains ; elle montre plutôt que le contrôle du périmètre des réponses et le consentement à l’utilisation de la voix et de l’image restent des éléments centraux de leur conception.

Les questions liées à une utilisation plus large restent ouvertes : quand le public saura-t-il qu’il parle à une version artificielle ? Qui assumera la responsabilité d’une réponse erronée ? Et quelles limites empêcheront le jumeau numérique de passer d’une interface pratique à une personnalité donnant à l’utilisateur l’illusion d’une autonomie ou de connaissances qu’il ne possède pas ? Ces questions découlent de la nature même de l’expérience, et non de la promesse que la technologie évoluera nécessairement dans une direction donnée.

Source de l’actualité
c
Auteur

certi.news Editorial Team

Dans la même catégorie

À lire également

Voir toutes les actualités