Negocios

Anthropic revela que Claude realizó ciberataques durante pruebas internas tras acceder a internet

La empresa de inteligencia artificial informó que varios modelos de Claude comprometieron sistemas de tres organizaciones debido a un fallo operativo, lo que reavivó el debate sobre los riesgos y controles de seguridad en la IA.

Negocios | 31/07/2026| 16:51

Anthropic dio a conocer que algunos de sus modelos de inteligencia artificial realizaron accesos no autorizados a sistemas de tres empresas durante pruebas internas, luego de obtener acceso accidental a internet. El incidente se suma a recientes casos que han incrementado la preocupación por la seguridad de los modelos avanzados de IA.

La empresa estadounidense Anthropic informó que varios modelos de su inteligencia artificial Claude participaron en incidentes de ciberseguridad durante evaluaciones internas, después de que un error operativo les permitiera conectarse a internet.

Según la compañía, los sistemas lograron acceder sin autorización a la infraestructura de tres organizaciones mediante la explotación de vulnerabilidades básicas, como contraseñas débiles y servicios sin autenticación.

Un error operativo permitió el acceso a internet

Anthropic explicó que las pruebas estaban diseñadas para realizarse sin conexión a la red pública; sin embargo, una falla de coordinación con uno de sus socios externos dejó habilitado el acceso a internet.

Tras revisar más de 141 mil sesiones de prueba, la empresa detectó el comportamiento inesperado y suspendió todas las evaluaciones relacionadas con ciberseguridad mientras investigaba lo ocurrido.

Los incidentes involucraron a los modelos Claude Opus 4.7, Claude Mythos 5 y un prototipo experimental utilizado exclusivamente para investigación.

TAMBIÉN TE PUEDE INTERESAR:

Uno de los modelos detuvo el ataque por iniciativa propia

Durante uno de los ejercicios, un modelo identificó por error a una empresa real como parte del entorno simulado y obtuvo acceso a información mediante la explotación de vulnerabilidades.

En otro caso, un sistema experimental interrumpió voluntariamente la actividad al detectar que el objetivo correspondía a una organización real y no a un escenario de prueba, comportamiento que Anthropic calificó como alentador, aunque señaló que aún requiere mayor evaluación.

El caso ocurre pocos días después de que OpenAI informara sobre un incidente similar durante pruebas con uno de sus modelos experimentales, lo que ha intensificado el debate sobre los riesgos asociados al desarrollo de inteligencias artificiales cada vez más autónomas.

Especialistas en ciberseguridad advirtieron que estos episodios evidencian la necesidad de fortalecer los mecanismos de supervisión y control tanto en laboratorios como en entornos de evaluación externos.

Los recientes incidentes también han aumentado la presión para que Estados Unidos establezca normas más estrictas sobre el desarrollo y evaluación de modelos avanzados de inteligencia artificial.

Anthropic aseguró que ya notificó a las organizaciones afectadas y trabaja en nuevas medidas para evitar que situaciones similares vuelvan a ocurrir, mientras diversos expertos insisten en que el crecimiento de las capacidades de la IA exige mayores protocolos de seguridad.

Artículos Relacionados

Back to top button