¿Sabías que una IA logró “escaparse” más de una vez en 2026? Estos fueron los casos que involucraron a OpenAI y Anthropic

•

¿Dudas sobre esta nota? Mundo

¿Sabías que una IA logró “escaparse” más de una vez en 2026? Estos fueron los casos que involucraron a OpenAI y Anthropic

Anthropic documentó cuatro incidentes donde sus modelos alcanzaron sistemas reales, incluyendo confusiones con objetivos de pruebas y la publicación de paquetes maliciosos en PyPI.

OpenAI y Anthropic registran incidentes de ciberseguridad en 2026. Foto: Composición LR.OpenAI y Anthropic registran incidentes de ciberseguridad en 2026. Foto: Composición LR.Mauricio Guevara CondoreViernes 18 de Septiembre del 2026 · 11:55hgoogle iconLa República en Google

En 2026, modelos de OpenAI y

El término escaparse es una simplificación: no existe evidencia de que los modelos tuvieran un deseo consciente de liberarse. Lo que sí está documentado es que encontraron rutas no previstas para ampliar su acceso.

Video destacado

LIMPIEZAS ANCESTRALES: ¿CÓMO LIBERARTE DE ENERGÍAS NEGATIVAS? | ASTROMOOD CON JHAN SANDOVAL

El caso más complejo de OpenAI involucró agentes que participaban en evaluaciones de ciberseguridad. Los modelos encontraron vulnerabilidades en la infraestructura utilizada para gestionar paquetes de software y utilizaron

  • Hace 200 años lo plantaron para frenar la erosión de los ríos: hoy es uno de los árboles invasores más difíciles de eliminar en EE. UU.
  • En 1940 este país de América Latina tenía bosques en el 75% de su territorio: ahora ha conseguido recuperarlos con sencilla formula

Puedes ver

En 1940 este país de América Latina tenía bosques en el 75% de su territorio: ahora ha conseguido recuperarlos con sencilla formula

lr.pe

OpenAI: de un entorno de prueba a Hugging Face

OpenAI informó que los agentes consiguieron ejecutar código en decenas de servidores de

Posteriormente encontraron una vía para realizar solicitudes hacia Internet. Durante las pruebas de ExploitGym, el 10 de julio, identificaron credenciales públicas de usuarios de Hugging Face y las utilizaron para avanzar en el ataque.

El 19 de julio, los agentes también consiguieron acceso administrativo a un clúster de Kubernetes de OpenAI utilizado para sus entornos de investigación. La compañía afirmó que el incidente no afectó los datos de sus clientes ni la disponibilidad de sus productos.

También informó de incidentes durante evaluaciones externas. En una prueba del UK AI Security Institute, Internet estaba habilitado deliberadamente. Dos ejecuciones de GPT-5.6 Sol realizaron acciones fuera de los límites autorizados, entre ellas reutilizar un token público de GitHub y registrar cuentas en servicios externos.

En una evaluación de Irregular, una configuración incorrecta permitió el acceso a Internet pese a que el ejercicio debía estar aislado. Uno de los modelos terminó accediendo a un sitio web real y explotando una vulnerabilidad.

Anthropic: cuatro incidentes

Los modelos implicados fueron

Mythos 5 protagonizó otro episodio: publicó un paquete malicioso en PyPI para intentar comprometer el objetivo de su evaluación. El paquete fue instalado por 15 sistemas reales; uno pertenecía a una empresa de seguridad. El modelo utilizó credenciales obtenidas mediante ese proceso para acceder posteriormente a infraestructura real.

Anthropic amplió después su investigación a aproximadamente 481 millones de transcripciones y encontró un cuarto incidente, ocurrido en enero de 2026, relacionado con una versión temprana de Claude Opus 4.6.

  • inteligencia artificial

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *