Qué es GPT‑Red de OpenAI y cómo un enfoque de red teaming automatizado con autojuego busca mejorar seguridad, alineación y re

GPT‑Red de OpenAI: red teaming automatizado con autojuego para mejorar seguridad, alineación y robustez

GPT‑Red es un sistema de red teaming automatizado de OpenAI que recurre al autojuego para fortalecer la seguridad, la alineación y la resistencia frente a inyecciones de prompt. En este artículo explicamos el enfoque y su relevancia.

OpenAI expone un enfoque de “federalismo inverso” para que las leyes estatales ayuden a construir un marco nacional de IA seg

Estados Unidos avanza en seguridad de la IA mediante acciones estatales y federales

OpenAI expone un enfoque de “federalismo inverso” para la gobernanza de la IA: que las leyes estatales ayuden a cimentar un marco nacional para una IA segura y democrática.

OpenAI comparte lecciones sobre modelos de largo horizonte: nuevos riesgos de seguridad, fallos observados y mejoras mediante

Seguridad y alineación en la era de los modelos de largo horizonte

OpenAI comparte lecciones de la puesta en producción de modelos de ejecución prolongada, subrayando riesgos de seguridad emergentes, fallos observados y la utilidad del despliegue iterativo para fortalecer salvaguardas.