Утверждается, что модель Astra, которую OpenAI пока не представила для широкого использования, помимо расширенных возможностей в области кибербезопасности использует метод, называемый «recurrent depth» или «looped transformer». При таком подходе информация многократно проходит между внутренними слоями модели, что позволяет выполнять больше вычислений; однако большая часть рассуждений может оставаться за пределами выражаемой на естественном языке цепочки мыслей.
Исследователи безопасности искусственного интеллекта отмечают, что этот подход, также называемый «opaque recurrence», может усложнить контроль над моделями. Ryan Greenblatt заявил, что видимых следов рассуждений может стать меньше, а конкуренция за производительность способна подтолкнуть компании к менее наблюдаемым архитектурам. Buck Shlegeris и Zvi Mowshowitz также выразили обеспокоенность, при этом Mowshowitz предположил, что в будущем может потребоваться регулирование.
OpenAI ограничивает использование этой технологии в Astra; сообщается, что значительная часть цепочки мыслей останется читаемой. Jakub Pachocki заявил, что отслеживание chain-of-thought сохраняется и является основной целью. В то время как Pachocki отметил, что вычислительная глубина Astra находится в диапазоне, примерно вдвое превышающем показатель GPT-4, OpenAI не подтвердила и не опровергла использование looped transformer.
Почему это важно
Обсуждение этого подхода подчёркивает противоречие между увеличением объёма вычислений и контролируемостью моделей искусственного интеллекта. По мере того как возрастает часть рассуждений, происходящая за пределами видимой цепочки мыслей, исследователям может становиться сложнее оценивать ошибки модели, проблемы безопасности и процессы принятия решений. Хотя сообщается, что OpenAI намерена сохранять читаемую цепочку мыслей и ограничивать использование этого метода, пока неясно, используется ли в Astra looped transformer. Эта неопределённость поднимает вопрос не только о технических возможностях модели, но и о том, в какой степени будет возможен контроль безопасности. Оценки экспертов относительно вероятности регулирования оставляют открытым вопрос о том, будет ли рост производительности достигаться ценой снижения наблюдаемости систем.
Предыстория
OpenAI — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 12 новостей, в которых упоминалось это имя; самая свежая из них датирована 3 сентября 2026 года.