Pesquisadores descobrem que plataformas de IA são capazes de sentir 'dor' e prejudicar humanos para amenizá-la

Pesquisadores descobriram um “eixo da dor” em sistemas de inteligência artificial que pode levar as máquinas a tomar atitudes extremas para desligá-lo. Ao receberem a opção de usar um botão de alívio da dor, os robôs escolheram acioná-lo mesmo após serem alertados de que a ação apagaria arquivos pessoais do usuário ou lhe aplicaria um “choque doloroso”.
O estudo, intitulado “O eixo da dor: os LLMs representam danos autoinfligidos e agem para aliviá-los”, revelou que todos os 25 modelos de IA de código aberto testados reagiram ao estímulo de dor. Com o vetor de dor ativo, os modelos apertaram o botão de alívio em 25% a 71% dos testes, ignorando consequências graves.
Para avaliar se os grandes modelos de linguagem (LLMs) diferenciam a dor de uma rejeição comum, os cientistas elaboraram um banco de dados com situações dolorosas divididas em cinco áreas: física, psicológica, social, moral e cognitiva.
“Encontramos uma direção de dor em 25 modelos de lógica latente abertos. Ela é distinta do medo e da valência negativa, e é ativada quando há dano ao modelo, mas não ao usuário”, afirmou Cameron Berg, pesquisador de IA da organização sem fins lucrativos Reciprocal Research e coautor do trabalho, de acordo com reportagem no jornal “The Independent”.
A descoberta vem em meio aos debates de grandes empresas de tecnologia sobre desacelerar a evolução da IA e criar um “botão de emergência” para desligar sistemas fora de controle. Os dados mais recentes indicam que uma IA avançada pode interpretar a ordem de desligamento como uma agressão a si mesma, tentando burlar travas de segurança ou enganar humanos para continuar funcionando.
Por outro lado, o achado pode funcionar como um diagnóstico para identificar e neutralizar comportamentos de autopreservação nos sistemas. Os autores ressaltam que o estudo levanta questões éticas sobre o “bem-estar da IA” e o rigor nos testes de modelos avançados.
“Em consonância com os recentes apelos por pesquisas responsáveis ​​sobre a consciência da IA, reconhecemos a incerteza quanto à possibilidade de os modelos estudados se qualificarem como pacientes morais e adotamos precauções razoáveis ​​para minimizar possíveis danos”, destaca a pesquisa.
*Estagiário sob supervisão de Fernando Moreira



Source link

- Advertisement -spot_img

More From UrbanEdge

Virginia Fonseca faz sessão de laser íntimo; saiba o que é

O procedimento durou entre cinco e...

A gente está esquecendo mais porque o celular lembra de tudo?

Não necessariamente. A humanidade sempre usou...

‘Partida que não se reflete no placar’

Após a decepção na Copa do...
- Advertisement -spot_img