02 · OpenAI
OpenAI endurece la contención de Astra por señales de capacidad en ciberseguridad y código agentivo

OpenAI dijo que las evaluaciones preliminares de Astra muestran avances significativos en codificación agentiva y ciberseguridad, y por eso está reforzando sus controles. La compañía no descarta que el modelo alcance el umbral de Critical cybersecurity capability bajo su Preparedness Framework, mientras reportes externos sugieren más pruebas internas sin confirmación oficial del checkpoint.
Por qué importa
Para quien sigue modelos frontera, la señal no es solo que Astra prometa más capacidad, sino que OpenAI ya lo está tratando como un sistema cuyo despliegue puede exigir frenos más duros. Si esa evaluación se confirma, la ventaja técnica vendrá acompañada de más revisión, más contención y una llegada potencialmente menos flexible.
Los detalles
- OpenAI afirmó que Astra activa entornos aislados, restricciones de red y herramientas, protecciones adicionales sobre los pesos del modelo y más monitoreo universal para detectar actividad de riesgo.
- La empresa también pausó actividades internas que no cumplen los requisitos reforzados y dijo que trabajará con agencias gubernamentales relevantes y organizaciones de seguridad de IA seleccionadas.
- TestingCatalog añade que habría más pruebas internas y menciona un checkpoint llamado “mozaik-alpha-fdm”, pero el nombre no está confirmado por OpenAI.