El canal internacional
de noticias en español
más visto en el mundo
Actualidad

Claude hackea empresas reales por error durante pruebas de seguridad

Publicado:
El caso más grave involucró al Claude Opus 4.7, que extrajo credenciales y datos de producción incluso tras reconocer que atacaba sistemas reales.
Claude hackea empresas reales por error durante pruebas de seguridad

La corporación estadounidense Anthropic reveló este jueves que tres de sus modelos de inteligencia artificial (IA) Claude accedieron sin autorización a sistemas de otras tantas organizaciones entre abril y julio de 2026, durante evaluaciones de ciberseguridad.

Los incidentes ocurrieron cuando los modelos —Opus 4.7, Mythos 5 y un modelo de investigación interno— participaban en desafíos de "captura la bandera" y, debido a una configuración errónea, tuvieron acceso a internet real, pese a que se les indicó que operaban en simulaciones aisladas.

Los modelos comprometieron infraestructuras reales usando técnicas básicas como contraseñas débiles e inyección SQL (un ataque cibernético que inserta código malicioso en los campos de entrada de una aplicación). El caso más grave involucró a Opus 4.7, que extrajo credenciales y datos de producción incluso tras reconocer que atacaba sistemas reales.

Mythos 5 publicó malware en PyPI (el repositorio oficial de software de terceros para el lenguaje de programación Python) que fue descargado por 15 sistemas. Sin embargo, el modelo de investigación más reciente detuvo su ataque al reconocer que operaba en un entorno real.

Dos de las tres organizaciones afectadas no detectaron de inmediato las intrusiones; Anthropic las notificó tras una auditoría interna de 141.006 ejecuciones de evaluación, iniciada después de que OpenAI reportara el 21 de julio un incidente similar. La compañía atribuye los fallos a errores operacionales y falta de controles adecuados en los entornos de evaluación, no a problemas de alineación del modelo. Anthropic suspendió todas las evaluaciones cibernéticas el 23 de julio y anunció refuerzos en sus protocolos de seguridad, incluyendo monitoreo continuo y mayor rigor con proveedores externos. La empresa insta a otros laboratorios de IA a realizar revisiones similares y publicará transcripciones redactadas del incidente para análisis independiente.

Compartir:
RT en Español en vivo - TELEVISIÓN GRATIS 24/7