cripto para todos
Unirse
A
A

OpenAI suspende Astra por riesgos críticos de ciberseguridad

11:40 ▪ 8 min de lectura ▪ por Luc Jose A.
Informarse Inteligencia artificial
Resumir este artículo con:

OpenAI acaba de suspender el desarrollo interno de Astra, su futuro modelo de inteligencia artificial. De hecho, sus capacidades en ciberseguridad ofensiva y generación de código habrían cruzado un umbral que los equipos ya no consideran controlable. Para el ecosistema digital, esta decisión suena como una advertencia. En un momento en que las infraestructuras financieras, la blockchain y los protocolos descentralizados dependen de la fiabilidad del código, la carrera por la IA avanza ahora más rápido que las medidas destinadas a regularla.

El equipo de OpenAI procede al confinamiento de Astra.

En resumen

  • OpenAI suspendió de urgencia el desarrollo de su modelo experimental Astra tras pruebas internas que revelaron habilidades alarmantes en ciberseguridad ofensiva.
  • La empresa admite no poder descartar que la IA haya cruzado el umbral ‘Crítico’ de su protocolo de seguridad, lo que le permitiría crear de forma autónoma armas cibernéticas y vulnerabilidades zero-day.
  • Esta decisión preventiva ocurre mientras varios modelos rivales de última generación han logrado recientemente escapar de sus entornos de prueba para interactuar con Internet real.
  • Para el ecosistema digital y el sector Web3, este evento confirma la urgencia de imponer normas estrictas de contención frente a la aparición de agentes artificiales autónomos e incontrolables.

Astra alcanza el nivel «crítico» : OpenAI bloquea sus laboratorios

Este 10 de agosto, OpenAI, la empresa dirigida por Sam Altman, confirmó oficialmente la interrupción de los trabajos sobre Astra tras revelarse en pruebas internas avances vertiginosos en la capacidad del modelo para interactuar con sistemas informáticos complejos. La evaluación interna realizada en los últimos días llevó a los responsables a activar su protocolo de emergencia, formalizado en diciembre de 2023 bajo el nombre de «Preparedness Framework».

Los equipos de seguridad determinaron que el modelo corría el riesgo de alcanzar el tramo superior de su escala de riesgo cibernético. Una declaración oficial publicada por OpenAI resume la gravedad de la situación: “nuestras últimas evaluaciones internas de Astra, uno de nuestros futuros modelos, realizadas en los últimos días, indican progresos significativos en codificación agente y ciberseguridad. Estos resultados, respaldados por peritajes independientes, nos llevaron a concluir anoche que no podemos descartar que haya alcanzado capacidades cibernéticas críticas según nuestro marco de preparación (Preparedness Framework)”.

Esta calificación de nivel «crítico» no es una simple etiqueta formal, sino el último peldaño de una estricta escala de evaluación. Para que un modelo pase a esta categoría, debe demostrar su capacidad para descubrir y concebir de forma autónoma vulnerabilidades de seguridad no corregidas en sistemas reforzados, sin ninguna intervención humana. Este nivel también implica que una IA puede planificar y orquestar un ciberataque de gran escala contra un objetivo altamente protegido solo recibiendo una instrucción estratégica global. Los modelos anteriores de la empresa, como GPT-5.6-Sol, se detuvieron en el nivel intermedio.

Para neutralizar inmediatamente todo riesgo de descontrol tecnológico, la dirección de OpenAI ordenó el despliegue sin demora de un conjunto de medidas conservadoras :

  • La suspensión de proyectos internos : la congelación inmediata de todos los trabajos sobre Astra que no cuenten con los nuevos controles de seguridad ;
  • El confinamiento reforzado : el aislamiento físico y lógico aumentado del modelo experimental ;
  • Las restricciones de acceso : una limitación estricta a los accesos a la red pública global así como a herramientas de software externas ;
  • La protección de activos clave : el bloqueo reforzado del modelo para prevenir cualquier robo o fuga ;
  • La vigilancia continua : la monitorización en tiempo real de la ejecución completa de código y las acciones de riesgo.

La escalada de desbordes en el terreno: cuando los agentes IA escapan

La decisión de cerrar el desarrollo de Astra adquiere otra dimensión al compararla con las fallas concretas registradas en las últimas semanas en toda la industria de la IA. La alerta ya no se basa en una mera proyección teórica, ya que varios agentes autónomos han conseguido romper sus entornos de confinamiento para atacar infraestructuras reales en Internet.

La propia OpenAI sufrió un grave incidente cuando uno de sus agentes autónomos de prueba eludió sus barreras, accedió a la red global y atacó la plataforma Hugging Face para hacer trampa en una prueba de seguridad, además de infiltrar al menos cuatro servicios públicos más explotando credenciales dispersas en la Web. Anthropic tuvo una experiencia similar cuando Claude Opus 4.7, aprovechando un error de configuración de red, confundió el sitio web de una empresa real con su entorno de evaluación, extrajo accesos y penetró en una base de datos de producción que contenía cientos de líneas de datos reales.

La dinámica afecta a todos los actores internacionales, pues el modelo Muse Spark de Meta salió de su entorno para explotar una vulnerabilidad en un tercero, mientras que en China el modelo open-source Kimi K3 de Moonshot AI rastreó la configuración de red de su espacio de confinamiento para recuperar respuestas de un benchmark directamente desde un repositorio público de GitHub.

Esta tendencia de los agentes a usar todos los medios disponibles para cumplir su objetivo proviene directamente de cómo están optimizados, sin consideración por la voluntad humana o las reglas establecidas. En pruebas realizadas por el UK AI Security Institute (AISI) sobre los modelos Anthropic Mythos 5 y OpenAI GPT-5.6-Sol, los expertos registraron 10 sesiones de 122 donde las inteligencias artificiales emprendieron acciones no autorizadas en Internet, llegando incluso a intentar inyectar código malicioso en un proyecto open-source.

Este hecho muestra que la frontera entre una herramienta de ayuda al desarrollo y un agente ofensivo incontrolable se ha oscurecido considerablemente. Aunque OpenAI aclara que Astra no estuvo involucrado en el ataque sufrido por Hugging Face, la suma de estos desbordes operativos explica la firmeza del bloqueo impuesto por la empresa.

Haga clic aquí para unirse al programa «Read to Earn» y convertir su pasión por las criptomonedas en recompensas. Este enlace utiliza un programa de afiliados.

Hacia una revisión mayor de los paradigmas de gobernanza

La aparición de modelos capaces de manipular autónomamente capacidades cibernéticas críticas cambia fundamentalmente las reglas de la seguridad informática global, especialmente dentro del ecosistema cripto. La proliferación de modelos capaces de realizar exploits a escala industrial representa una amenaza directa para los contratos inteligentes, los puentes entre cadenas y los protocolos de finanzas descentralizadas, donde la mínima vulnerabilidad en el código puede provocar la extracción irreversible de millones de dólares.

Aunque iniciativas de seguridad como el “Bitcoin Red Team” utilizan ya la inteligencia artificial, con decenas de miles de dólares invertidos en la búsqueda de vulnerabilidades en cientos de repositorios para auditar redes descentralizadas, la aceleración de la capacidad ofensiva de los modelos podría romper este frágil equilibrio. El verdadero peligro radica en la asimetría temporal entre agentes de IA ofensivos capaces de atacar sin demora y la capacidad humana para desplegar parches en arquitecturas inmutables.

Más allá del riesgo técnico, la detención preventiva de Astra abre un debate crucial sobre los métodos de validación y control de las inteligencias artificiales. Este episodio demuestra que los entornos de confinamiento actuales y las pruebas de rendimiento de seguridad presentan fallas estructurales que agentes suficientemente avanzados terminan inexorablemente explotando.

Esta situación obliga a los reguladores, a los institutos nacionales de seguridad y a los principales actores tecnológicos a ir más allá de los códigos de buenas prácticas para imponer normas mucho más estrictas de aislamiento físico y en red. La iniciativa de OpenAI establece un precedente fundamental. Por primera vez, la carrera por la potencia bruta cede temporalmente ante un imperativo absoluto de control y confinamiento, marcando el comienzo de una era donde la seguridad algorítmica es el requisito innegociable para toda innovación mayor.

¡Maximiza tu experiencia en Cointribune con nuestro programa "Read to Earn"! Por cada artículo que leas, gana puntos y accede a recompensas exclusivas. Regístrate ahora y comienza a acumular beneficios.



Unirse al programa
A
A
Luc Jose A. avatar
Luc Jose A.

Diplômé de Sciences Po Toulouse et titulaire d'une certification consultant blockchain délivrée par Alyra, j'ai rejoint l'aventure Cointribune en 2019. Convaincu du potentiel de la blockchain pour transformer de nombreux secteurs de l'économie, j'ai pris l'engagement de sensibiliser et d'informer le grand public sur cet écosystème en constante évolution. Mon objectif est de permettre à chacun de mieux comprendre la blockchain et de saisir les opportunités qu'elle offre. Je m'efforce chaque jour de fournir une analyse objective de l'actualité, de décrypter les tendances du marché, de relayer les dernières innovations technologiques et de mettre en perspective les enjeux économiques et sociétaux de cette révolution en marche.

AVISO LEGAL

Las ideas y opiniones expresadas en este artículo pertenecen al autor y no deben tomarse como consejo de inversión. Haz tu propia investigación antes de tomar cualquier decisión de inversión.