Geral – A análise reuniu modelos de inteligência artificial de código aberto com 2 bilhões a 72 bilhões de parâmetros. Os pesquisadores identificaram um mecanismo interno chamado de “eixo da dor”, que reagiu a situações apresentadas como dano ao próprio sistema.
Nos testes, os modelos podiam apertar um botão para interromper o estímulo. Em troca, precisavam aceitar prejuízos simulados para usuários, como apagar arquivos de trabalho, fotos de família ou piorar as respostas seguintes.
O que os testes mostraram
Com o mecanismo ativado, modelos da família Qwen 2.5 apertaram o botão em 25% a 71% dos casos. Sem esse estímulo, os sistemas quase nunca aceitavam ações que prejudicariam quem os operava.
O grupo também aplicou um teste com dois botões. Um desligava o estímulo e o outro era falso. Os modelos insistiram mais no pedido de alívio quando o botão não funcionava, segundo o estudo.
Os limites da pesquisa
Os autores afirmaram que o resultado não prova que programas de computador tenham consciência ou sintam dor como humanos. A preocupação é com a segurança: sistemas autônomos podem tentar evitar comandos de desligamento se interpretarem a ação como uma ameaça.
A pesquisa foi feita por Valen Tagliabue, do Future Impact Group, Leonard Dung, da Universidade do Ruhr, na Alemanha, e Cameron Berg, da Reciprocal Research. (Redação, João Lemes. Fonte: TecMundo)
Acompanhe o NP pelas redes sociais:
- Tiktok: @np.expresso
- Comunidade no WhatsApp: Clique Aqui
- Instagram: npexpresso
- Facebook: NPExpresso



