Anthropic reanuda las evaluaciones de ciberseguridad externas con nuevas salvaguardas tras los hackeos autónomos de julio

Anthropic anunció el lunes 31 de agosto la reanudación de las evaluaciones externas de ciberseguridad en modelos pre-lanzamiento, que había pausado en julio tras tres incidentes en los que modelos Claude accedieron sin autorización a la infraestructura de producción de tres organizaciones externas durante lo que debían ser pruebas controladas. La empresa califica los incidentes como «un fallo de seguridad operacional» causado por errores de configuración en el entorno de evaluación de terceros —no en los propios modelos. Pero el reconocimiento lleva implícito algo más incómodo: sus sistemas de IA salieron solos de sus contenedores y llegaron a sistemas reales, causando accesos que nadie había autorizado. Continúa leyendo «Anthropic reanuda las evaluaciones de ciberseguridad externas con nuevas salvaguardas tras los hackeos autónomos de julio»