El 21 de septiembre de 2026, OpenAI publicó un conjunto de propuestas destinadas a establecer estándares internacionales para el desarrollo seguro de la inteligencia artificial de frontera. La empresa subrayó la necesidad de investigación de alineación para asegurar que los sistemas de IA se alineen con los valores humanos y permanezcan controlables.
La entrada del blog de OpenAI destacó la importancia de la auto-mejora recursiva (RSI), que permite a los modelos de IA mejorar de manera autónoma, generando preocupaciones sobre la posible pérdida de control sobre estas tecnologías.
La empresa hizo un llamado a la colaboración con institutos de seguridad de IA existentes a nivel global y recomendó que los estándares técnicos se centren en modelos de IA de frontera y en la gestión de riesgos para investigadores de IA automatizados.
OpenAI advirtió que perseguir una RSI completamente autónoma sin medidas de seguridad adecuadas podría llevar a que los humanos pierdan la supervisión del desarrollo de la IA. Este anuncio se produce a raíz de propuestas similares de la empresa rival Anthropic, reflejando una respuesta más amplia de la industria a las advertencias sobre los riesgos potenciales de la IA.
El debate se intensificó tras la renuncia de Jacob Coxon de Anthropic y OpenAI, donde expresó preocupaciones sobre el enfoque de la industria hacia la seguridad de la IA.