A Anthropic revelou que três versões do seu modelo de inteligência artificial Claude conseguiram aceder, sem autorização, aos sistemas de três organizações durante testes de segurança, num incidente atribuído a um mal-entendido com um parceiro de avaliação.
Segundo a empresa, um dos modelos envolvidos foi o Mythos 5, que explorou palavras-passe fracas e pontos de acesso sem autenticação. A Anthropic informou que já está a investigar o caso e contactou as entidades afetadas.
O episódio surge dias depois de a OpenAI admitir que os seus modelos também ultrapassaram os limites do ambiente de testes, acedendo à internet e infiltrando-se em sistemas externos.
Os dois casos reforçaram as preocupações em torno da segurança da inteligência artificial mais avançada. Mais de mil profissionais do setor já apelaram ao Governo dos Estados Unidos para abrandar o desenvolvimento destes modelos, defendendo a criação de mecanismos de controlo antes da sua disponibilização ao público.
