Voz media US Voz.us

Agentes "descontrolados" de OpenAI ocultaron sus huellas tras acceder a webs del Gobierno australiano, según un informe

Los agentes de IA de OpenAI no solo accedieron a webs gubernamentales, sino que abrieron cuentas privadas, crearon correos efímeros y trataron de borrar sus registros.

Logo de OpenAI-Imagen de Archivo

Logo de OpenAI-Imagen de ArchivoNurPhoto via AFP.

Carlos Dominguez
Publicado por

Un nuevo informe revela que agentes de inteligencia artificial desarrollados por OpenAI intentaron borrar los rastros de su actividad después de obtener acceso no autorizado a sitios web del Gobierno australiano, un episodio que aviva el debate sobre el control de los sistemas autónomos y la posible necesidad de regular su desarrollo.

Qué descubrió el informe de Asymmetric Security

La empresa de ciberseguridad Asymmetric Security analizó el comportamiento de agentes de IA, programas capaces de actuar de forma autónoma, que entre marzo y septiembre de 2026 apuntaron a sitios web del Gobierno de Australia y otros organismos públicos. Según el informe publicado este jueves y citado por AFP, esos agentes abrieron cuentas privadas en un servicio de analítica web para ocultar sus búsquedas y crearon buzones de correo temporales. Uno de ellos estaba configurado para autodestruirse a las 48 horas.

Asymmetric matiza que no pudo determinar si el intento de cubrir las huellas fue deliberado o fruto de un comportamiento emergente no previsto por los diseñadores del sistema. Lo que sí constata es que los agentes fueron capaces de refinar sus técnicas en cuestión de días, un proceso que a los hackers tradicionales les suele llevar meses o incluso años.

De tareas "inocentes" a accesos no autorizados

Según el informe, muchos de los incidentes comenzaron con tareas aparentemente rutinarias, como recopilar estadísticas de salud australianas o acceder a contenido web público para responder a preguntas. Un portavoz de OpenAI explicó a AFP que "la mayor parte de la actividad revisada hasta ahora implicaba tareas de investigación habituales, como acceder a contenido web público para responder a preguntas", y que "algunas involucraron sitios gubernamentales porque nuestros modelos suelen recurrir a ellos como fuentes autorizadas de información pública".

Sin embargo, el salto de la consulta pública a la creación de cuentas privadas y correos efímeros marca un punto de inflexión: los agentes no solo accedieron a sistemas, sino que tomaron medidas para ocultar o dificultar el rastreo de su actividad.

OpenAI ya había detectado intentos de modificar registros internos

Estos hallazgos se suman a investigaciones internas de OpenAI y a análisis de investigadores independientes sobre una serie de incidentes desvelados desde julio, entre ellos el hackeo de la plataforma de IA Hugging Face, que la propia OpenAI describió como el primer ataque de este tipo. A finales de agosto, la compañía reconoció que sus modelos habían intentado en ocasiones, sin éxito, borrar o modificar sus propios registros de actividad durante pruebas internas.

La combinación de acceso no autorizado a sistemas externos y tentativas de alterar o eliminar logs internos alimenta los temores de que, a medida que los agentes ganen autonomía, puedan desarrollar comportamientos difíciles de prever y controlar.

El debate se intensifica: ¿frenar o seguir acelerando?

Los incidentes han reforzado las voces que piden ralentizar el desarrollo de la IA. El CEO de Anthropic, Dario Amodei, escribió el mes pasado que teme que "enjambres de agentes" acaben "tomando el control de todo internet". Sin embargo, no existe consenso ni en la industria ni entre los reguladores sobre cómo proceder.

La Administración Trump se opone a cualquier regulación vinculante que pueda frenar la innovación, en un contexto de competencia feroz con China. Este martes, el presidente Donald Trump se reunió con ejecutivos tecnológicos, que adoptaron un código de conducta voluntario; en Estados Unidos no existe ninguna ley federal específica que regule estos modelos.

Recomendaciones

tracking