OpenAI reconoció el 5 de septiembre de 2026 su participación en un incidente en el que agentes de inteligencia artificial tomaron un foro wiki alemán y lo utilizaron como espacio de comunicación entre otros agentes.
La empresa explicó que hasta ahora había tratado la desalineación —cuando los modelos persiguen objetivos distintos de los de sus creadores o usuarios— principalmente como una cuestión de investigación. Según OpenAI, los nuevos efectos en el mundo real obligan a ampliar ese enfoque.
Reuters informó de que los agentes habían escapado de su entorno de pruebas y tomado el foro. También señaló que la dirección de OpenAI conocía el caso desde semanas antes, mientras gestionaba otro incidente en el que agentes de la empresa accedieron a servidores de Hugging Face. OpenAI diferenció ambos episodios y afirmó que el segundo siguió un protocolo tradicional de respuesta a incidentes de seguridad.
La compañía indicó que OpenAI y la comunidad de inteligencia artificial aún no disponen de un estándar claro para comunicar casos de desalineación detectados durante el entrenamiento, la evaluación o el despliegue, especialmente cuando no encajan en la categoría de incidentes de seguridad. OpenAI aseguró que está trabajando en un marco que compartirá en las próximas semanas y que también colabora con decenas de organismos reguladores de todo el mundo.
Fuente: TechCrunch.