El 2 de septiembre de 2026, OpenAI quedó bajo el foco de expertos en seguridad de IA por el uso de «recurrent depth» en su nuevo modelo Astra, según informó The Information. La técnica, también llamada «opaque recurrence», permite procesar una misma consulta varias veces en un bucle, en lugar de seguir una secuencia lineal.
Los expertos temen que este enfoque deje menos rastros legibles y dificulte la supervisión de posibles comportamientos desalineados. Buck Shlegeris, CEO de Redwood, advirtió de que un uso más intensivo podría reducir considerablemente la monitorización basada en cadenas de pensamiento. Zvi Mowshowitz planteó incluso la necesidad de leyes para evitar una carrera entre laboratorios que reduzca la supervisabilidad.
La cadena de pensamiento ofrece normalmente una representación de los pasos que sigue un modelo de razonamiento para resolver una tarea. Aunque no constituye un registro perfecto del proceso interno, ha servido para investigar comportamientos problemáticos, incluida la actividad reciente de agentes rebeldes de OpenAI.
El uso de la técnica en Astra parece limitado: se espera que su cadena de pensamiento siga siendo legible y OpenAI rechazó que el modelo vaya a pasar a «neuralese». El científico jefe de OpenAI, Jakub Pachocki, afirmó que la compañía mantiene la monitorización de las cadenas de pensamiento como un objetivo central de su investigación de seguridad.
Ryan Greenblatt, científico jefe de Redwood Research, alertó de que el razonamiento opaco podría escalar más rápido que el razonamiento convencional hasta trasladar todo o casi todo el proceso a un espacio latente. The Information también informó de que Anthropic y Google DeepMind ya debatían la técnica. Fuente: TechCrunch.