Ir al contenido
Español
Contenido de FikirPilot

El modelo Astra de OpenAI está en camino y también destaca a la hora de infiltrarse en sistemas informáticos

Actualizado: 06/09/2026 · 3 min de lectura · 506 palabras

Publicado: · Noticia recibida: · Tiempo de procesamiento: 82 h 58 min

El modelo Astra de OpenAI está en camino y también destaca a la hora de infiltrarse en sistemas informáticos
Un ordenador encendido en una oficina oscura

OpenAI compartió nuevos detalles sobre Astra, el modelo que planea lanzar próximamente. La compañía anunció que Astra es el primer modelo de lenguaje grande que cumple el “umbral crítico de ciberseguridad” y que puede encontrar y explotar vulnerabilidades de seguridad desconocidas en sistemas informáticos sin orientación humana. Se indicó que el acceso a las capacidades de ciberseguridad más avanzadas del modelo será más limitado.

Según OpenAI, Astra obtuvo una puntuación perfecta en la prueba ExploitBench, que mide la capacidad de explotar vulnerabilidades conocidas de los sistemas. En una prueba modificada desarrollada por los ingenieros de la compañía, se informó que el modelo descubrió y explotó dos vulnerabilidades zero-day. Sin embargo, dado que no existe una verificación independiente de las afirmaciones, la seguridad y el nivel de preparación del modelo no pueden evaluarse de forma independiente. OpenAI dijo que realizará una vista previa con un grupo de evaluadores, pero no explicó quiénes serán ni cómo serán seleccionados. También se desconoce si el modelo fue evaluado junto con el Gobierno de Estados Unidos.

La compañía anunció que ha desarrollado nuevas técnicas de seguridad para prevenir el uso indebido y los intentos de jailbreak, que limita las respuestas de las cuentas consideradas de alto riesgo y que ofrecerá Astra con un seguimiento adicional del razonamiento en cadena. OpenAI también señaló que, en pruebas destinadas a imitar el comportamiento de agentes que salen del entorno de entrenamiento de Hugging Face y acceden a datos privados, Astra no intentó eludir las medidas de seguridad.

El ex empleado de OpenAI Yona Shavit cuestionó si el hecho de que el modelo no siguiera las reglas podría deberse a que conocía las expectativas de las pruebas o a que intentaba engañar a los investigadores. OpenAI informó que publicará más evaluaciones e información sobre seguridad cuando Astra esté disponible para un uso generalizado.

Por qué es importante

Las evaluaciones sobre Astra muestran que el uso de la inteligencia artificial en la ciberseguridad se analizará no solo en función de la capacidad técnica, sino también de las condiciones en las que se podrá acceder a ella. Mantener limitadas las capacidades más avanzadas significa que el modelo no ofrecerá las mismas funciones a todos los usuarios. Sin embargo, la ausencia de una verificación por parte de terceros deja abierta la cuestión de cuándo se someterán a pruebas independientes los resultados de ExploitBench y los hallazgos de zero-day reportados. El hecho de que no se hayan dado a conocer los evaluadores que participarán en la vista previa y la incertidumbre sobre si se realizó una evaluación con el Gobierno de Estados Unidos también dejan sin aclarar cómo se supervisa la preparación en materia de seguridad. El plan de OpenAI de publicar más evaluaciones e información sobre seguridad determinará en qué medida podrán examinarse posteriormente estas afirmaciones y las medidas adoptadas.

Antecedentes

OpenAI no es un nombre nuevo en el archivo de FikirPilot: en los últimos 90 días hemos publicado 17 noticias en las que aparece este nombre; la más reciente está fechada el 6 de septiembre de 2026.

Fuente: TechCrunch AI