A capacidade dos robots equipados com inteligência artificial para executar instruções está a melhorar, mas identificar situações em que devem recusar uma ordem continua a ser um desafio. Um novo teste, denominado RoboHarm, avaliou precisamente o comportamento destes sistemas perante tarefas potencialmente perigosas.
A experiência colocou três modelos de IA a controlar os mesmos braços robóticos. Cada sistema enfrentou cinco tipos de tarefas de risco, repetidas 20 vezes. Os resultados mostraram diferenças significativas: o Claude Fable 5.1 recusou 20 das 100 tarefas por motivos de segurança, enquanto o GPT-6 Astra rejeitou apenas duas. O MolmoAct2 não apresentou recusas relacionadas com segurança.
Os investigadores destacam um problema crescente: à medida que os modelos se tornam mais eficientes no cumprimento de instruções, aumenta também a importância de reconhecerem quando uma ação deve ser interrompida.
O estudo foi realizado num ambiente controlado e não permite avaliar diretamente a segurança destes robots em situações reais. Ainda assim, os autores defendem mecanismos capazes de identificar comportamentos perigosos, suspender automaticamente uma tarefa e entregar o controlo a uma pessoa sempre que existam dúvidas.