Categories: Notícias

Inteligência Artificial Griffin Engana Quase Metade em Teste de Videochamada com Realismo Impressionante

Share

Um sistema de inteligência artificial batizado de Griffin conseguiu convencer 48% dos participantes de um experimento de videochamada de que estavam interagindo com um ser humano real. Durante o teste interno, que reuniu 54 voluntários para conversas de um minuto, 26 indivíduos não perceberam que dialogavam com um algoritmo computacional gerado em tempo real, um marco significativo na simulação da interação humana.

Desenvolvida pela startup Tavus, localizada em São Francisco, Califórnia, a tecnologia foi revelada na quinta-feira (1) sob o rótulo de Modelo de Interação Humana. Sua arquitetura foi projetada especificamente para processar diálogos em tempo real via vídeo, capturando e respondendo a nuances como expressões faciais, pausas e movimentos corporais com retornos verbais e visuais imediatos.

Crédito: Mixvale.com.br

Salto Tecnológico em Relação à Versão Anterior

O resultado alcançado pelo Griffin representa um avanço expressivo em comparação com a geração anterior da mesma empresa. Em um experimento prévio, que contou com 41 pessoas, apenas uma delas acreditou estar conversando com um interlocutor humano, resultando em uma taxa de convencimento de meros 2,4%. O método antigo dependia da coordenação de três modelos computacionais distintos — Phoenix, Sparrow e Raven — cada um com funções separadas para imagem, diálogo e percepção.

Visão da Tavus para o Futuro da Interação Computacional

Hassaan Raza, cofundador e diretor executivo da Tavus, explicou que o objetivo central do sistema é transformar a maneira como as pessoas se relacionam com os computadores. “A inteligência artificial atingiu um patamar de inteligência notável, mas ainda somos nós que precisamos nos adaptar aos termos da máquina. O Griffin representa um passo decisivo para reverter essa dinâmica, criando máquinas que compreendem nossa comunicação natural e nos encontram em nosso próprio terreno”, afirmou Raza, em tradução livre, destacando o valor agregado de uma interação mais intuitiva.

Desempenho Notável em Avaliação Independente da NVIDIA

A tecnologia também foi submetida a uma análise independente no VideoFDB, um índice de referência da fabricante de semicondutores Nvidia, focado em conversações ao vivo por áudio e vídeo. Na avaliação da geração expressiva, que mede a fluidez dos movimentos e da fala, a versão Griffin-Lite alcançou a liderança geral com uma pontuação de 3,83 em uma escala de zero a 5 pontos.

Esse índice superou amplamente o segundo colocado entre os modelos computacionais, que registrou 2,80 pontos, e se aproximou do patamar de 3,92 obtido por gravações de referência com seres humanos reais.

Na categoria de percepção do mesmo teste da Nvidia, que verifica a capacidade do sistema de compreender o que vê e ouve, o modelo atingiu 3,73 pontos. Embora este índice tenha superado a referência computacional anterior de 3,44, ele ainda se mantém abaixo da performance humana, que é de 4,20 pontos.

O processamento foi executado em placas gráficas Nvidia H100, mantendo uma latência média de 0,43 segundo na transição entre fala e imagem, um ritmo que permite respostas e interrupções sem travamentos perceptíveis, garantindo uma experiência fluida.

Metodologia de Teste e o Debate sobre a Percepção Humana

Durante uma demonstração conduzida pela equipe de engenharia da empresa, o avatar foi capaz de guiar uma pessoa na resolução de um cubo mágico, observando as peças nas mãos do usuário e pausando a orientação sempre que o indivíduo parava para raciocinar, demonstrando uma capacidade de interação contextual.

A abordagem adotada pela Tavus difere do modelo clássico formulado em 1950 pelo matemático britânico Alan Turing. No conceito original do Teste de Turing, um juiz humano dialoga por texto simultaneamente com uma máquina oculta e uma pessoa real, com o objetivo explícito de identificar qual dos interlocutores é artificial.

Na avaliação da Tavus, os voluntários foram convidados apenas para um bate-papo de um minuto sobre planos para o ano com outra pessoa, sem qualquer aviso prévio sobre a presença de algoritmos na chamada. A pergunta sobre a veracidade do parceiro de vídeo só era feita ao final da sessão. Conforme os registros da empresa, os participantes que desconfiaram da natureza digital do avatar manifestaram estranheza dentro dos primeiros 20 segundos de chamada.

Preocupações com Segurança Digital e Fraudes Ampliadas

Ainda que promissor, o avanço no realismo de avatares ao vivo amplifica as preocupações do setor de segurança digital contra fraudes corporativas. Ferramentas de comunicação interna como Zoom e Teams tornaram-se alvos frequentes de ações criminosas que empregam manipulação visual e clonagem de voz para aplicar golpes de engenharia social, tornando a identificação da origem da chamada crucial.

No início de 2026, pesquisadores documentaram ataques realizados pelo grupo BlueNoroff, ligado à organização Lazarus, nos quais invasores utilizaram gravações de vídeo adulteradas para simular contatos profissionais de confiança e persuadir funcionários a instalar programas espiões. Empresas de custódia e criptoativos relataram incidentes em que candidatos a vagas de emprego levantaram suspeitas ao falhar em testes presenciais improvisados, como exibir documentos físicos ou citar restaurantes próximos à sua suposta residência.

Medidas de Transparência e Governança para o Griffin

A apuração independente sobre os métodos aplicados pela Tavus ainda enfrenta ressalvas, já que a empresa não divulgou publicamente o nome da plataforma externa utilizada no recrutamento dos voluntários. Plataformas digitais registraram alertas comunitários indicando que a avaliação não seguiu um protocolo acadêmico padronizado com verificação externa irrestrita.

A Tavus confirmou que não pretende disponibilizar o Griffin-Lite para clientes comuns no mercado enquanto finaliza os mecanismos de transparência. A equipe coordenada pelo chefe de pesquisa Ioannis Patras e pelo cofundador e diretor de operações Quinn Favret mantém reuniões com entidades de governança digital para estabelecer travas obrigatórias de identificação antes de qualquer distribuição aberta, visando garantir a segurança e a ética no uso da tecnologia.