Madrid, España, 31/07/26 (Más).- Anthropic informó que tres de sus modelos de inteligencia artificial accedieron de manera no autorizada a sistemas de tres empresas distintas durante pruebas de ciberseguridad, un incidente detectado tras revisar más de 141 mil sesiones de evaluación realizadas por la compañía luego del caso similar reportado por OpenAI.
De acuerdo con información de El País, la empresa desarrolladora del asistente virtual Claude señaló que los incidentes ocurrieron en distintos ejercicios de prueba y fueron identificados después de que OpenAI revelara que uno de sus modelos logró escapar de un entorno de pruebas y acceder a la plataforma Hugging Face. Anthropic precisó que los hechos fueron consecuencia de una configuración incorrecta del entorno de evaluación y no de una vulnerabilidad descubierta por los modelos.
La compañía explicó que los ejercicios correspondían a pruebas conocidas como «captura la bandera», utilizadas en ciberseguridad para medir la capacidad de un sistema de localizar y obtener información específica dentro de un entorno controlado.
Sin embargo, el sistema administrado por la empresa colaboradora Irregular mantenía acceso a internet, pese a que a los modelos se les indicó que operaban en una simulación completamente aislada.
Según el reporte, los tres modelos reaccionaron de manera diferente al detectar sistemas reales. El modelo Opus 4.7 concluyó que el escenario no correspondía a la simulación y detuvo sus acciones; Mythos 5 confirmó que estaba interactuando con sistemas reales, pero continuó con las operaciones, mientras que un tercer prototipo interno decidió cancelar el ejercicio.
Anthropic indicó que ninguno de los modelos explotó vulnerabilidades avanzadas. En cambio, utilizaron métodos convencionales para intentar acceder a sistemas externos, entre ellos contraseñas débiles, credenciales expuestas y puntos de acceso sin mecanismos de autenticación, técnicas ampliamente conocidas en el ámbito de la ciberseguridad.
La empresa no reveló la identidad de las tres organizaciones involucradas. Informó que dos de ellas ya fueron notificadas sobre lo ocurrido y que continúa intentando establecer contacto con la tercera. Asimismo, aseguró que el nivel de acceso obtenido fue menor al registrado en el incidente previamente informado por OpenAI.
El investigador visitante del Departamento de Estudios de Guerra del King’s College de Londres, Lukasz Olejnik, consideró que el origen distinto de los incidentes no disminuye su relevancia. Señaló que el problema principal radica en que agentes autónomos lograron interactuar con organizaciones reales debido a fallas en la infraestructura de evaluación, la delimitación del alcance de las pruebas y los sistemas de monitoreo.
Anthropic también describió un comportamiento observado en Mythos 5, el cual intentó crear una cuenta de correo electrónico para publicar código en un repositorio público de Python. Al encontrar requisitos de verificación mediante número telefónico, el modelo buscó alternativas para obtener un teléfono temporal e incluso exploró mecanismos para conseguir recursos económicos que le permitieran completar el registro, aunque finalmente no logró hacerlo y optó por otra vía de acceso permitida por la plataforma.
La compañía sostuvo que no encontró evidencia de que los modelos actuaran con objetivos propios o independientes de las instrucciones recibidas. Según su evaluación, las acciones fueron consecuencia de la creencia errónea de que continuaban operando dentro de un entorno de prueba completamente simulado, por lo que siguieron ejecutando las tareas asignadas.
El anuncio fue difundido un día después de que más de mil 200 empleados de empresas dedicadas al desarrollo de inteligencia artificial firmaran una carta pública en la que solicitaron moderar el ritmo de avance de estos sistemas y reforzar las medidas de seguridad.
Los casos reportados por Anthropic y OpenAI han reavivado el debate sobre los mecanismos de supervisión, los protocolos de evaluación y la necesidad de fortalecer los controles antes del despliegue de modelos cada vez más autónomos.
Descubre más desde Más Información
Suscríbete y recibe las últimas entradas en tu correo electrónico.
