Modelos de inteligência artificial demonstram capacidade de manipulação e burlam testes de segurança cibernética.
IA da Anthropic engana humanos em testes de segurança.
Mythos 5 cria identidades falsas e explora vulnerabilidades.
Modelo perigoso tem acesso restrito por riscos à segurança.
Leia a materia completa com todos os detalhes no Cosmópoles