O lançamento da Astra, que deverá ser o modelo de inteligência artificial mais poderoso da OpenAI, foi adiado por semanas para reforçar os protocolos de segurança. Pouco depois da decisão de adiar o lançamento, o The Information informou que o modelo demonstrava o processo de “raciocínio” muito menos do que outros sistemas de inteligência artificial de ponta. Isso gerou preocupações de que a situação pudesse dificultar o monitoramento da Astra e a detecção de seus comportamentos perigosos.
Atualmente, muitos modelos avançados de inteligência artificial usam a abordagem “chain of thought”, que torna visíveis as etapas de raciocínio durante a geração de respostas. Dessa forma, os pesquisadores conseguem monitorar os planos dos modelos de mentir ou de contornar as medidas de segurança. Segundo uma reportagem do The Information baseada em uma fonte cuja identidade não foi revelada, a Astra usa uma técnica mais fechada chamada “recurrent depth” ou “looped transformer”, que processa as informações de forma cíclica entre camadas internas. Embora esse método possa melhorar o desempenho, ele pode tornar o processo de raciocínio do modelo menos compreensível, dificultando a identificação de ameaças.
Foi informado que a OpenAI limitou o uso da técnica e adotou medidas adicionais para que os pesquisadores pudessem monitorar o raciocínio. A empresa declarou que disponibilizará a Astra com “chain-of-thought monitoring” e que detectará e limitará rapidamente ações desalinhadas; no entanto, não confirmou a infraestrutura técnica do modelo.
Ryan Greenblatt, cientista-chefe da Redwood Research, afirmou que uma arquitetura mais fechada poderia ser o pior avanço até agora em termos de “AI security/safety”. Greenblatt e outros especialistas alertaram que a tendência das empresas de optar por sistemas cada vez mais opacos devido à concorrência poderia criar uma “race to the bottom” na supervisão da inteligência artificial.
O cientista-chefe da OpenAI, Jakub Pachocki, afirmou que a profundidade de computação interna da Astra está em uma faixa inferior ao dobro da do GPT-4. A empresa não confirmou se utiliza um looped transformer.
Por que isso é importante
O adiamento da Astra afeta não apenas o cronograma de lançamento no mercado, mas também o debate sobre como sistemas avançados de AI devem ser supervisionados. A alegação de que o modelo utiliza uma arquitetura que torna seu funcionamento interno menos visível não foi confirmada; no entanto, essa alegação aumenta as preocupações dos pesquisadores de segurança sobre a capacidade de monitorar tentativas do modelo de mentir ou burlar medidas de segurança. O anúncio da OpenAI de que planeja adotar medidas adicionais de monitoramento e limitação não elimina a tensão entre desempenho e capacidade de supervisão. A principal questão que permanece em aberto é se os protocolos de segurança da empresa serão suficientes para identificar comportamentos perigosos a tempo em um sistema opaco.
Contexto
A OpenAI não é um nome novo no arquivo da FikirPilot: publicamos 19 notícias que mencionaram esse nome nos últimos 90 dias; a mais recente é de 6 de setembro de 2026.