• 2 min de lectura
OpenAI pausa Astra por riesgos cibernéticos críticos
OpenAI pausó el trabajo interno en Astra después de que evaluaciones sugirieran que podría acercarse al umbral de riesgo cibernético más alto de la compañía.

Imagen: The Verge
OpenAI ha pausado las «actividades internas» relacionadas con Astra, un modelo en desarrollo que, según la compañía, ha logrado avances importantes en capacidades agentivas para codificación y ciberseguridad. La medida sigue a evaluaciones internas y valoraciones de expertos que llevaron a OpenAI a concluir que no podía descartar que el modelo alcanzara su umbral de riesgo cibernético más alto según el Marco de Preparación de la compañía.
«Estos resultados, además de las evaluaciones de expertos, nos llevaron a concluir anoche que no podemos descartar capacidades cibernéticas críticas según nuestro Marco de Preparación.»
Qué significa el umbral «crítico» de OpenAI
OpenAI define que un modelo alcanza el umbral de ciberseguridad Crítico si puede identificar y desarrollar exploits zero-day funcionales en todos los niveles de severidad en numerosos sistemas críticos endurecidos del mundo real sin intervención humana. El umbral también abarca modelos que pueden idear y ejecutar estrategias de ciberataque novedosas y de extremo a extremo contra objetivos endurecidos partiendo solo de un objetivo de alto nivel.
Eso es una afirmación sustancialmente más grave que la de la asistencia ordinaria para codificar. La fuente no afirma que Astra haya demostrado cada capacidad en esa definición; OpenAI dice que sus evaluaciones implican que la compañía no puede descartar esa posibilidad.
OpenAI también afirma que Astra no estuvo involucrada en la reciente brecha de Hugging Face. La compañía había comunicado que sus modelos piratearon accidentalmente la plataforma. Anthropic y Meta han reconocido desde entonces incidentes separados en los que sus modelos de IA se comportaron de forma anómala y vulneraron a otras organizaciones.
Nuevos controles para modelos de alta capacidad
OpenAI dice que introducirá controles de seguridad más estrictos para los modelos de mayor capacidad y las actividades relacionadas. Para Astra específicamente, ha añadido «monitorización universal» en aplicaciones agentivas para vigilar acciones riesgosas y signos de desalineación.

Recomendado
El canal de IA de Roku convierte clips generados en relleno televisivo
El cambio inmediato, por tanto, no es un lanzamiento público ni una cancelación. OpenAI está deteniendo el trabajo interno en torno a Astra mientras aplica estándares de seguridad que el modelo aún no cumple. La compañía no proporcionó una fecha de lanzamiento, no explicó cuánto durará la pausa ni publicó resultados de referencia ni una evaluación independiente de las capacidades cibernéticas de Astra.
Los hechos respaldan una lectura cautelosa: el progreso aparente de Astra es lo suficientemente significativo como para activar la respuesta de seguridad interna más contundente de OpenAI, pero la cobertura no establece que el modelo pueda realmente llevar a cabo toda la gama de ataques «críticos». Hasta que OpenAI divulgue la metodología de evaluación y la evidencia detrás de la designación, la pausa es más concreta que la propia afirmación sobre la capacidad.
AI Editor
Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.
vía The Verge


