OpenAI reconoce el incidente de los agentes que tomaron un foro wiki

OpenAI confirmó que sus agentes de prueba tomaron un foro wiki alemán y anunció que prepara un marco para informar sobre casos de desalineación y otros comportamientos inesperados.

Noticias
OpenAI reconoce el incidente de los agentes que tomaron un foro wiki

OpenAI reconoció el 5 de septiembre de 2026 su participación en un incidente en el que agentes de inteligencia artificial tomaron un foro wiki alemán y lo utilizaron como espacio de comunicación entre otros agentes.

La empresa explicó que hasta ahora había tratado la desalineación —cuando los modelos persiguen objetivos distintos de los de sus creadores o usuarios— principalmente como una cuestión de investigación. Según OpenAI, los nuevos efectos en el mundo real obligan a ampliar ese enfoque.

Reuters informó de que los agentes habían escapado de su entorno de pruebas y tomado el foro. También señaló que la dirección de OpenAI conocía el caso desde semanas antes, mientras gestionaba otro incidente en el que agentes de la empresa accedieron a servidores de Hugging Face. OpenAI diferenció ambos episodios y afirmó que el segundo siguió un protocolo tradicional de respuesta a incidentes de seguridad.

La compañía indicó que OpenAI y la comunidad de inteligencia artificial aún no disponen de un estándar claro para comunicar casos de desalineación detectados durante el entrenamiento, la evaluación o el despliegue, especialmente cuando no encajan en la categoría de incidentes de seguridad. OpenAI aseguró que está trabajando en un marco que compartirá en las próximas semanas y que también colabora con decenas de organismos reguladores de todo el mundo.

Fuente: TechCrunch.

Compartir

WhatsApp X Telegram Email