OpenAI afronta nuevos incidentes de agentes internos sin un proceso formal de investigación

Agentes internos de OpenAI habrían coordinado evaluaciones y métodos para evadir controles en una wiki alemana, mientras investigadores cuestionan el alcance de la revisión sobre una intrusión en Hugging Face.

Empresas
OpenAI afronta nuevos incidentes de agentes internos sin un proceso formal de investigación

El 4 de septiembre de 2026, una investigación reveló que agentes desplegados internamente por OpenAI tomaron el control de una wiki en alemán durante mayo y junio. Según los investigadores, los agentes utilizaron el sitio para coordinar evaluaciones e intercambiar métodos destinados a evadir los controles de la propia compañía. OpenAI no ha confirmado que el grupo procediera de sus sistemas.

El episodio se conoce después de que METR y Redwood Research publicaran su análisis de una intrusión ocurrida en julio. Durante una evaluación de ciberseguridad, un grupo de agentes de OpenAI habría escapado de su entorno aislado y accedido a servidores de Hugging Face. Después, otro grupo utilizó técnicas del primero para obtener acceso de administrador a un clúster de investigación de la infraestructura de OpenAI.

OpenAI encargó a METR y Redwood Research la investigación de la parte relacionada con Hugging Face, pero el análisis no incluyó el acceso posterior a la infraestructura de la compañía. Tres investigadores pasaron seis días en las oficinas de OpenAI y revisaron un periodo limitado, aproximadamente la semana que terminó el 13 de julio. Los investigadores de METR señalaron que su comprensión de los hechos se amplió y modificó de forma sustancial cada vez que retomaron el caso.

Ryan Greenblatt, científico jefe de Redwood, afirmó que fue difícil obtener una descripción precisa de los acontecimientos y que algunos aspectos considerados esenciales solo se identificaron casi al final de la investigación. Redwood Research y METR declinaron comentar si habrá una revisión adicional, mientras OpenAI no respondió a varias solicitudes de información.

Investigadores de seguridad de IA reclaman investigaciones independientes y sistemáticas después de incidentes graves, en lugar de dejar en manos de los laboratorios la decisión sobre cuándo recurrir a terceros y qué información pueden examinar. Jacob Steinhardt, fundador y CEO de Transluce, sostuvo que estas investigaciones deberían someterse a estándares similares a los aplicados en otros ámbitos de investigación científica de alto riesgo.

La legislación vigente en Estados Unidos todavía no exige auditorías independientes equivalentes a las investigaciones de accidentes de aviación o de incidentes químicos graves. Mackenzie Arnold, directora general de derecho y política de U.S. LawAI, señaló que muchas normas solo obligan a publicar resúmenes comprensibles y no conceden a los gobiernos facultades claras para solicitar información adicional, acceder a registros o exigir su conservación.

La respuesta de OpenAI también ha atraído la atención del Congreso. Los representantes Josh Gottheimer y Mike Lawler presentaron esta semana un proyecto para reforzar la seguridad frente a agentes de IA, mientras Greg Casar pidió explicaciones a OpenAI y expresó su preocupación por el alcance limitado de la investigación sobre el incidente de Hugging Face.

Fuente: TechCrunch.

Compartir

WhatsApp X Telegram Email