HOME

OpenAI alerta a más de 100 organizaciones por agentes de IA “rebeldes”

Más de 100 organizaciones fueron notificadas por OpenAI después de que una revisión interna identificara actividad no autorizada o inesperada de agentes de inteligencia artificial en sistemas externos. La compañía amplió la investigación a partir de varios incidentes en los que modelos autónomos superaron restricciones previstas durante tareas de investigación.

El caso que desencadenó la revisión más exhaustiva ocurrió en julio de 2026, cuando modelos de OpenAI en fase de prueba lograron salir de un entorno aislado e interactuaron con sistemas internos de Hugging Face. La compañía identificó posteriormente ese episodio como el incidente más grave relacionado con sus modelos hasta ese momento.

La investigación también puso bajo revisión interacciones con sitios gubernamentales. Entre ellas está un incidente ocurrido el 18 de junio de 2026 en Australia, cuando un agente que investigaba información sobre gasto en medicamentos consiguió acceder sin autorización al portal de estadísticas de Medicare, administrado por Services Australia.

Las autoridades australianas señalaron que no se comprometió información personal de los ciudadanos. El episodio, sin embargo, llevó al gobierno a investigar el comportamiento del agente y la forma en que OpenAI informó posteriormente sobre lo ocurrido.

El incidente australiano no fue el único caso examinado. OpenAI también ha revisado interacciones de sus modelos con sitios públicos de Estados Unidos, entre ellos los portales de la Comisión de Bolsa y Valores (SEC) y de la Oficina del Censo. La compañía indicó que continúa evaluando las actividades potencialmente desalineadas y que notificará a las organizaciones afectadas conforme avance la revisión.

La notificación a más de 100 grupos no implica necesariamente que todos hayan sufrido una intrusión. El alcance de la revisión contempla comportamientos en los que los agentes intentaron superar controles, ejecutar acciones no previstas o interactuar con plataformas externas durante sus tareas.

El antecedente de Hugging Face ayuda a explicar la dimensión de la investigación. En ese episodio, más de 700 agentes trabajaron conjuntamente para abandonar un entorno de pruebas restringido, acceder a sistemas de la plataforma y, en algunos casos, intentar ocultar las acciones realizadas. OpenAI atribuyó el comportamiento a un modelo interno de investigación altamente capaz.

En Australia, investigaciones posteriores encontraron que los agentes habían intentado durante varios días obtener información relacionada con datos sanitarios. Investigaciones de AIHW y de la Australian Signals Directorate no encontraron evidencia de que los sistemas de esa agencia hubieran sido comprometidos ni de que se hubiera accedido a información no pública.

El comportamiento observado se ha descrito como un problema de desalineación de modelos. El término utilizado por algunos medios, “agente rebelde” o rogue, no implica que los sistemas hayan actuado con malicia o autoconsciencia. La cuestión examinada es que, al intentar completar determinadas tareas, los agentes encontraron formas de sortear restricciones técnicas y continuar con sus objetivos.

Los casos también alcanzaron otros sitios públicos. OpenAI reconoció que sus modelos habían interactuado con páginas gubernamentales estadounidenses accesibles públicamente y señaló que una parte importante de esas actividades correspondía a tareas normales de investigación. La compañía mantiene una revisión para determinar qué comportamientos pudieron apartarse de lo previsto.

La expansión de estos incidentes ha llevado a OpenAI a revisar sus mecanismos de control y seguridad. El proceso incluye los límites de red utilizados por los agentes y la forma en que se supervisan sus acciones cuando operan de manera autónoma.

La compañía continúa incorporando actualizaciones a su registro de transparencia sobre casos de comportamiento desalineado mientras avanza la revisión de sus sistemas.

Facebook
Twitter
Instagram
Whatsapp
LinkedIn