Início Tecnologia A IA pode passar no Teste de Turing em chats ao vivo...

A IA pode passar no Teste de Turing em chats ao vivo e parecer mais humana do que nós. Estou assustado agora

76
0

A IA pode passar no Teste de Turing em chats ao vivo, e o resultado mais recente chega com arrepios. Em um Estudo da UC San Diegoo GPT-4.5 superou os participantes reais em convencer os juízes de que havia uma pessoa do outro lado.

A configuração foi mais difícil de ignorar do que um benchmark padrão. Os juízes reagiram às trocas em tempo real, em vez de aos prompts estáticos, e então fizeram uma ligação rápida baseada apenas na conversa.

A parte perturbadora é o quão familiar a habilidade parece. A modelo não precisava de corpo, voz ou biografia. Só precisava soar como alguém.

Como a IA venceu o teste humano

O estudo utilizou uma versão tripartida do teste. Os juízes conversaram com uma pessoa e com um modelo de IA e escolheram qual deles consideravam real.

O GPT-4.5 foi identificado como humano 73% das vezes quando recebeu uma solicitação de persona. LLaMa-3.1-405B também cruzou uma linha impressionante, sendo escolhido como humano 56% das vezes com uma solicitação de persona.

Esses números dão força à descoberta. O modelo não apenas evitou a detecção, mas também deu aos juízes pistas sociais suficientes para interpretá-lo como a pessoa no chat.

Por que este teste ainda importa

O Teste de Turing é uma maneira antiga de perguntar se uma máquina pode imitar uma conversa humana bem o suficiente para enganar uma pessoa. Na versão clássica, um avaliador conversa sem ver os participantes e depois tenta diferenciar o humano da máquina.

Sempre foi mais um símbolo cultural do que uma medida limpa. Ainda assim, continua sendo o teste que as pessoas reconhecem quando querem saber se um software pode passar por um de nós.

Isso faz com que o novo resultado pareça mais nítido. Um chatbot não precisa de consciência, emoção ou autoconsciência para criar a impressão de que uma pessoa real está digitando de volta. Só precisa ser crível no momento.

O risco aparece em lugares comuns. Suporte ao cliente, aplicativos de namoro, plataformas sociais, educação e mensagens políticas dependem de julgamentos rápidos sobre identidade, intenção e autenticidade.

O que devemos assistir a seguir

O estudo não chega a dizer que os chatbots entendem as pessoas. A sua conclusão mais prática é que alguns modelos podem agora desempenhar extremamente bem a personalidade em trocas curtas.

Uma divulgação mais clara deverá tornar-se o próximo ponto de pressão. Quando um bot consegue se misturar a uma conversa casual, os usuários precisam de sinais mais fortes de que estão lidando com software, especialmente em locais onde a persuasão ou a vulnerabilidade emocional moldam a troca.

A próxima briga é pela rotulagem em chats, onde as pessoas tomam decisões rápidas sobre confiança.

fonte