Opiniões e análises

Meu gêmeo digital fala em meu nome: a experiência com a Synthesia levanta questões de confiança na mídia

Uma jornalista da TechCrunch experimentou criar uma versão digital interativa de si mesma por meio da Synthesia, treinada em uma única história e capaz de respondê-la por áudio e vídeo. A experiência revela as possibilidades do gêmeo digital, mas levanta questões mais profundas sobre confiança e os limites de seu uso no jornalismo e no ambiente corporativo.

2026-09-26
4 min de leitura
2 visualizações
certi.news Editorial Team
Meu gêmeo digital fala em meu nome: a experiência com a Synthesia levanta questões de confiança na mídia

A Synthesia criou uma versão digital interativa da jornalista da TechCrunch Dominic-Madori Davis, depois de capturar várias imagens dela e gravar dois minutos de sua voz. O resultado não foi apenas uma imagem recitando um texto escrito, mas um Avatar que ouve as perguntas e as converte em texto, usa um modelo de linguagem para formular a resposta e transforma a resposta em voz, enquanto um modelo de vídeo movimenta os traços da personagem durante a fala.

A jornalista escolheu treinar a versão interativa com uma história que havia escrito sobre os motivos do aumento dos casos de fraude em startups financiadas por capital de risco em comparação com as que não recebem esse tipo de financiamento. Por isso, o gêmeo era “determinístico”; ou seja, só respondia dentro do escopo para o qual havia sido preparado e redirecionava as perguntas fora desse escopo para a história original.

Como o gêmeo digital foi construído?

A equipe da Synthesia precisou de alguns dias para criar os modelos. A jornalista recebeu versões personalizadas que leem os textos fornecidos por ela e versões interativas capazes de ouvir e responder, com opções com ou sem óculos. O sistema usa os modelos de vídeo e voz da Synthesia, além de permitir a escolha de modelos alternativos da Cartesia, ElevenLabs, Google e OpenAI, bem como opções para hospedar o gêmeo na nuvem escolhida pelo cliente ou na Synthesia.

A empresa organiza esses recursos em três categorias principais: uma plataforma para criar e distribuir vídeos usando Avatars tradicionais, a plataforma interativa Sessions para pesquisas e exercícios de simulação e uma API que permite integrar modelos de voz e vídeo a outros serviços para criar Avatars interativos ou produtos diferentes.

O que a experiência revela?

A jornalista considerou que a voz estava próxima da sua na versão personalizada, mas seus amigos acharam a semelhança na versão interativa menos convincente. Ainda assim, a presença foi suficiente para produzir uma sensação de estranheza, a ponto de seus pais tentarem fazer perguntas pessoais cujas respostas só os familiares conheciam, sem obter resposta por causa das limitações impostas pelo treinamento.

Esse resultado evidencia uma diferença importante entre um Avatar com escopo controlado e uma versão alimentada por um modelo de conversação aberto. O primeiro é relativamente previsível, mas tem utilidade limitada fora do material com o qual foi treinado. O segundo pode parecer mais flexível, mas abre espaço para respostas inventadas ou comportamentos difíceis de controlar.

Por que essa notícia é importante?

A autora considera que o possível uso no jornalismo é a questão mais importante: o público aceitaria que as notícias fossem apresentadas por uma personalidade digital? Um Avatar poderia substituir um jornalista ou permitir que executivos conversassem com uma versão digital do jornalista em vez de falar com a própria pessoa? Sua posição é clara em um ponto fundamental: a essência do jornalismo é a confiança, e ela não acredita que esse elemento possa ser facilmente delegado à inteligência artificial.

Fora da mídia, a ideia pode ser mais atraente para empresas e indivíduos, já que uma versão digital poderia responder a perguntas durante a ausência de seu proprietário ou ajudar no treinamento e no atendimento a funcionários e clientes. Mas a experiência não prova que esses modelos estejam prontos para substituir seres humanos; ela mostra que o controle do escopo das respostas e o consentimento para o uso da voz e da imagem continuam sendo partes centrais de seu design.

As questões sobre o uso mais amplo permanecem em aberto: quando o público saberá que está falando com uma versão artificial? Quem será responsável por uma resposta errada? E quais limites impedem que o gêmeo digital passe de uma interface prática a uma personalidade que leve o usuário a acreditar em uma autonomia ou conhecimento que ele não possui? Essas são perguntas baseadas na própria natureza da experiência, não em uma promessa de que a tecnologia necessariamente evoluirá em uma direção específica.

Fonte da notícia
TechCrunch AI
Abrir fonte original ↗
c
Autor

certi.news Editorial Team

Na mesma categoria

Você também pode gostar

Ver todas as notícias