OpenAI comparte lecciones sobre modelos de largo horizonte: nuevos riesgos de seguridad, fallos observados y mejoras mediante

Seguridad y alineación en la era de los modelos de largo horizonte

OpenAI comparte lecciones de la puesta en producción de modelos de ejecución prolongada, subrayando riesgos de seguridad emergentes, fallos observados y la utilidad del despliegue iterativo para fortalecer salvaguardas.