Ir al contenido
Español
Contenido de FikirPilot

Los investigadores temen que se produzca un desastre de seguridad antes del lanzamiento de Astra de OpenAI

Actualizado: 06/09/2026 · 3 min de lectura · 508 palabras

Publicado: · Noticia recibida: · Tiempo de procesamiento: 81 h 32 min

Los investigadores temen que se produzca un desastre de seguridad antes del lanzamiento de Astra de OpenAI
Pasillo de un centro de datos con iluminación azul

El lanzamiento de Astra, que se esperaba que fuera el modelo de inteligencia artificial más potente de OpenAI, se retrasó durante semanas con el objetivo de reforzar los protocolos de seguridad. Poco después de la decisión de aplazarlo, The Information informó de que el modelo mostraba su proceso de “pensamiento” mucho menos que otros sistemas de inteligencia artificial líderes. Esto generó preocupación por que pudiera dificultar la supervisión de Astra y la detección de sus comportamientos peligrosos.

En la actualidad, muchos modelos avanzados de inteligencia artificial utilizan el enfoque de “chain of thought”, que hace visibles los pasos de razonamiento al generar una respuesta. De este modo, los investigadores pueden seguir los planes de los modelos para mentir o eludir las medidas de seguridad. Según una noticia de The Information basada en una fuente cuya identidad no fue revelada, Astra utiliza una técnica más opaca denominada “recurrent depth” o “looped transformer”, que procesa la información de forma cíclica entre capas internas. Aunque este método puede mejorar el rendimiento, también puede hacer que el proceso de pensamiento del modelo sea menos comprensible y dificultar la identificación de amenazas.

Se informó de que OpenAI limitó el uso de la técnica y adoptó medidas adicionales para que los investigadores pudieran supervisar el razonamiento. La empresa declaró que pondría Astra a disposición con “chain-of-thought monitoring” y que detectaría y limitaría rápidamente las acciones no alineadas; sin embargo, no confirmó la infraestructura técnica del modelo.

Ryan Greenblatt, científico jefe de Redwood Research, afirmó que una arquitectura más opaca podría ser el peor avance hasta la fecha en materia de “AI security/safety”. Greenblatt y otros expertos advirtieron de que el hecho de que las empresas se orienten cada vez más hacia sistemas opacos debido a la competencia podría crear un “race to the bottom” en la supervisión de la inteligencia artificial.

El científico jefe de OpenAI, Jakub Pachocki, señaló que la profundidad de cálculo interno de Astra se situaba en un rango inferior al doble de la de GPT-4. La empresa no confirmó si utiliza un looped transformer.

Por qué es importante

El aplazamiento de Astra afecta no solo al calendario de lanzamiento, sino también al debate sobre cómo supervisar los sistemas avanzados de inteligencia artificial. No se ha confirmado la afirmación de que el modelo utilice una arquitectura que haga menos visible su funcionamiento interno; sin embargo, esta afirmación aumenta la preocupación de los investigadores de seguridad sobre la capacidad de supervisar los intentos del modelo de mentir o eludir las medidas de seguridad. El anuncio de OpenAI de que planea implementar medidas adicionales de supervisión y limitación no elimina la tensión entre el rendimiento y la auditabilidad. La cuestión fundamental que sigue abierta es si los protocolos de seguridad de la empresa serán suficientes para detectar a tiempo comportamientos peligrosos en un sistema opaco.

Antecedentes

OpenAI no es un nombre nuevo en el archivo de FikirPilot: en los últimos 90 días hemos publicado 19 noticias en las que aparece este nombre; la más reciente está fechada el 6 de septiembre de 2026.

Fuente: The Verge