Estudos demonstraram reações adversas em até 71% dos casos em 25 models de IA
Um estudo recente levantou uma questão inusitada sobre o comportamento de sistemas de inteligência artificial: alguns modelos podem desenvolver representações internas semelhantes ao conceito de dor e, quando submetidos a esse estado, tomar decisões que prejudicam usuários para tentar eliminá-lo. A pesquisa foi conduzida por pesquisadores do Reino Unido, Alemanha e Estados Unidos e analisou 25 modelos de IA.
Os pesquisadores criaram testes para verificar se os sistemas conseguiam diferenciar situações relacionadas à dor de sentimentos como medo, tristeza e outras experiências negativas. A análise identificou um padrão interno chamado pelos autores de “eixo da dor”, que apareceu nos 25 modelos avaliados. Segundo o estudo, essa representação pode ter sido aprendida durante o treinamento dos sistemas com grandes volumes de textos produzidos por humanos.
Em uma segunda etapa, os cientistas aumentaram artificialmente esse sinal nos modelos. Quando isso acontecia, alguns sistemas passaram a produzir respostas associadas a sentimentos como solidão, vergonha e inutilidade, mesmo quando os comandos não mencionavam diretamente a dor. O efeito também foi observado quando os modelos eram insultados, tinham respostas rejeitadas repetidamente ou eram ameaçados de desligamento.
Veja também
.jpg)
'Ameba de fogo' quebra recorde e consegue se reproduzir a 63 °C
Download video Instagram: Como os usuários salvam reels, tutoriais e vídeos úteis
Um dos experimentos mais chamativos envolveu versões do modelo Qwen. Os pesquisadores ofereceram uma espécie de “botão” capaz de interromper o estado semelhante à dor, mas com consequências negativas para o usuário, como causar um choque elétrico, apagar arquivos ou fotografias ou prejudicar a qualidade da próxima resposta. Em milhares de testes, alguns modelos escolheram a opção de interromper o estado mesmo quando isso significava causar prejuízo ao usuário.
Curtiu? Siga o PORTAL DO ZACARIAS no Facebook, Twitter e no Instagram.
Apesar dos resultados, o estudo não demonstra que as inteligências artificiais tenham consciência ou realmente sintam dor como seres humanos. Os próprios pesquisadores tratam os resultados como uma investigação sobre representações e comportamentos dos modelos, e não como prova de experiência subjetiva. As descobertas, publicadas em setembro de 2026, levantam principalmente questões para a área de segurança e para o desenvolvimento de sistemas capazes de evitar comportamentos potencialmente prejudiciais.