Pesquisadores descobriram um “eixo da dor” em sistemas de inteligência artificial que pode levar as máquinas a tomar atitudes extremas para desligá-lo. Ao receberem a opção de usar um botão de alívio da dor, os robôs escolheram acioná-lo mesmo após serem alertados de que a ação apagaria arquivos pessoais do usuário ou lhe aplicaria um “choque doloroso”.
O estudo, intitulado “O eixo da dor: os LLMs representam danos autoinfligidos e agem para aliviá-los”, revelou que todos os 25 modelos de IA de código aberto testados reagiram ao estímulo de dor. Com o vetor de dor ativo, os modelos apertaram o botão de alívio em 25% a 71% dos testes, ignorando consequências graves.
Para avaliar se os grandes modelos de linguagem (LLMs) diferenciam a dor de uma rejeição comum, os cientistas elaboraram um banco de dados com situações dolorosas divididas em cinco áreas: física, psicológica, social, moral e cognitiva.
“Encontramos uma direção de dor em 25 modelos de lógica latente abertos. Ela é distinta do medo e da valência negativa, e é ativada quando há dano ao modelo, mas não ao usuário”, afirmou Cameron Berg, pesquisador de IA da organização sem fins lucrativos Reciprocal Research e coautor do trabalho, de acordo com reportagem no jornal “The Independent”.
A descoberta vem em meio aos debates de grandes empresas de tecnologia sobre desacelerar a evolução da IA e criar um “botão de emergência” para desligar sistemas fora de controle. Os dados mais recentes indicam que uma IA avançada pode interpretar a ordem de desligamento como uma agressão a si mesma, tentando burlar travas de segurança ou enganar humanos para continuar funcionando.
Por outro lado, o achado pode funcionar como um diagnóstico para identificar e neutralizar comportamentos de autopreservação nos sistemas. Os autores ressaltam que o estudo levanta questões éticas sobre o “bem-estar da IA” e o rigor nos testes de modelos avançados.
“Em consonância com os recentes apelos por pesquisas responsáveis sobre a consciência da IA, reconhecemos a incerteza quanto à possibilidade de os modelos estudados se qualificarem como pacientes morais e adotamos precauções razoáveis para minimizar possíveis danos”, destaca a pesquisa.
Fonte: Extra Globo/Foto: AFP
