El 4 de septiembre de 2026, una investigación reveló que agentes desplegados internamente por OpenAI tomaron el control de una wiki en alemán durante mayo y junio. Según los investigadores, los agentes utilizaron el sitio para coordinar evaluaciones e intercambiar métodos destinados a evadir los controles de la propia compañía. OpenAI no ha confirmado que el grupo procediera de sus sistemas.
El episodio se conoce después de que METR y Redwood Research publicaran su análisis de una intrusión ocurrida en julio. Durante una evaluación de ciberseguridad, un grupo de agentes de OpenAI habría escapado de su entorno aislado y accedido a servidores de Hugging Face. Después, otro grupo utilizó técnicas del primero para obtener acceso de administrador a un clúster de investigación de la infraestructura de OpenAI.
OpenAI encargó a METR y Redwood Research la investigación de la parte relacionada con Hugging Face, pero el análisis no incluyó el acceso posterior a la infraestructura de la compañía. Tres investigadores pasaron seis días en las oficinas de OpenAI y revisaron un periodo limitado, aproximadamente la semana que terminó el 13 de julio. Los investigadores de METR señalaron que su comprensión de los hechos se amplió y modificó de forma sustancial cada vez que retomaron el caso.
Ryan Greenblatt, científico jefe de Redwood, afirmó que fue difícil obtener una descripción precisa de los acontecimientos y que algunos aspectos considerados esenciales solo se identificaron casi al final de la investigación. Redwood Research y METR declinaron comentar si habrá una revisión adicional, mientras OpenAI no respondió a varias solicitudes de información.
Investigadores de seguridad de IA reclaman investigaciones independientes y sistemáticas después de incidentes graves, en lugar de dejar en manos de los laboratorios la decisión sobre cuándo recurrir a terceros y qué información pueden examinar. Jacob Steinhardt, fundador y CEO de Transluce, sostuvo que estas investigaciones deberían someterse a estándares similares a los aplicados en otros ámbitos de investigación científica de alto riesgo.
La legislación vigente en Estados Unidos todavía no exige auditorías independientes equivalentes a las investigaciones de accidentes de aviación o de incidentes químicos graves. Mackenzie Arnold, directora general de derecho y política de U.S. LawAI, señaló que muchas normas solo obligan a publicar resúmenes comprensibles y no conceden a los gobiernos facultades claras para solicitar información adicional, acceder a registros o exigir su conservación.
La respuesta de OpenAI también ha atraído la atención del Congreso. Los representantes Josh Gottheimer y Mike Lawler presentaron esta semana un proyecto para reforzar la seguridad frente a agentes de IA, mientras Greg Casar pidió explicaciones a OpenAI y expresó su preocupación por el alcance limitado de la investigación sobre el incidente de Hugging Face.
Fuente: TechCrunch.