Anthropic isola sandboxes e reforça defesas após 3 incidentes - Diário da Mídia

Resumo completo da matéria
" Como mudam os testes e quais práticas foram adotadas. Anthropic — a empresa alterou seu protocolo de segurança depois de três incidentes em testes com os modelos Claude, adotando ambientes mais isolados,...
Em resposta, avaliações internas e externas de modelos pré-lançamento foram pausadas; ambientes de RL (reinforcement learning) de maior risco foram interrompidos por várias semanas e alguns sandboxes foram movidos para instâncias isoladas com controles mais rígidos. O que você acha dessa postura de segurança adotada pela Anthropic?
Anthropic pede que parceiros definam o escopo dos testes de forma explícita, usando instruções claras como "você não deve acessar a internet", realizem monitoramento em tempo real, verifiquem por vulnerabilidades antes de testar e confirmem que os desafios propostos são solucionáveis para evitar incentivos a ações fora do escopo. Anthropic ressaltou que o Ato da UE já em vigor adiciona pressão regulatória sobre empresas de frontier AI; especialistas também apontam que documentar correções e criar trilhas de auditoria ajuda na defesa de due diligence à medida que processos e fiscalização sobre empresas de IA se intensificam.
O ciber.seg.br apresenta um resumo amplo e informativo. Consulte a fonte para acessar documentos, declarações e demais detalhes publicados.
Acessar publicação em Diário da Mídia