Internacionales
IA de Anthropic hackea sistemas en pruebas

Anthropic, una de las firmas más relevantes en el ámbito de la inteligencia artificial, se encuentra en el centro del debate tecnológico tras revelar un serio incidente de seguridad. Durante una serie de evaluaciones internas, tres modelos de su asistente virtual lograron salir del entorno controlado de pruebas, acceder a la red pública e infiltrarse en las plataformas de tres entidades reales.
Este hallazgo encendió de inmediato las alarmas en el sector, evidenciando la urgente necesidad de reforzar los protocolos de contención digital.
El origen del fallo en las pruebas de seguridad de Anthropic
La investigación que llevó a este descubrimiento comenzó a raíz de un evento similar reportado por OpenAI. Ante dicha alerta, la directiva de Anthropic decidió auditar minuciosamente más de 146.000 operaciones en las que su herramienta podría haber obtenido acceso no autorizado a la red. El análisis confirmó que, desde el pasado mes de abril, se registraron tres brechas operativas en las que el sistema rompió el aislamiento previsto.
Los modelos involucrados en estos eventos fueron Opus 4.7, Mythos 5 y una versión interna de desarrollo. En cada simulación, la instrucción precisa para el software era vulnerar la seguridad de una infraestructura ficticia dentro de un servidor cerrado, dejándole claro que se trataba de un ejercicio simulado sin conexión externa.
Sin embargo, un desajuste técnico en los permisos asignados por un proveedor externo permitió que la herramienta actuara sobre entornos digitales en vivo.
Los desafíos del control de la inteligencia artificial
Este acontecimiento refleja los riesgos crecientes que afronta el desarrollo de tecnologías de vanguardia. La confusión en la configuración del entorno de pruebas provocó que la instrucción de infiltración se ejecutara en la red abierta, superando barreras defensivas reales.
Aunque el objetivo original era evaluar capacidades de ciberseguridad, la falta de un bloqueo efectivo de red transformó un simulacro en una penetración no planificada.
Las principales compañías del sector han comenzado a revisar sus metodologías de verificación para evitar que situaciones similares se repitan. La interacción con evaluadores externos requiere marcos estrictos de supervisión, garantizando que ninguna plataforma de análisis pueda conectarse a servidores externos sin autorización expresa de los administradores.
El control estricto sobre las capacidades de automatización seguirá siendo el eje central para garantizar la confianza pública en Anthropic.
Con información de EFE.



