Запуск Astra, которая, как ожидается, станет самой мощной моделью искусственного интеллекта OpenAI, был отложен на несколько недель с целью усилить протоколы безопасности. Вскоре после решения об отсрочке The Information сообщило, что по сравнению с другими передовыми системами искусственного интеллекта модель демонстрирует гораздо меньше этапов процесса «мышления». Это вызвало опасения, что за Astra станет сложнее наблюдать и выявлять её опасное поведение.
Сегодня многие передовые модели искусственного интеллекта используют подход «chain of thought», делающий видимыми этапы рассуждения при формировании ответа. Благодаря этому исследователи могут отслеживать планы моделей по лжи или обходу мер безопасности. Согласно сообщению The Information со ссылкой на источник, пожелавший сохранить анонимность, Astra использует более закрытую технологию под названием «recurrent depth» или «looped transformer», которая циклически обрабатывает информацию между внутренними слоями. Этот метод может повысить производительность, но одновременно сделать процесс «мышления» модели менее понятным и затруднить выявление угроз.
Сообщается, что OpenAI ограничила использование этой технологии и приняла дополнительные меры, чтобы исследователи могли отслеживать рассуждения. Компания заявила, что выпустит Astra с «chain-of-thought monitoring» и будет быстро выявлять и ограничивать несогласованные действия, однако не подтвердила техническую архитектуру модели.
Главный научный сотрудник Redwood Research Ryan Greenblatt заявил, что более закрытая архитектура может стать «худшим из произошедшего до сих пор» с точки зрения «AI security/safety». Greenblatt и другие эксперты предупредили, что постепенный переход компаний к всё более непрозрачным системам из-за конкуренции может привести к «race to the bottom» в области надзора за искусственным интеллектом.
Главный научный сотрудник OpenAI Jakub Pachocki заявил, что внутренняя глубина вычислений Astra находится в диапазоне менее чем вдвое больше, чем у GPT-4. Компания не подтвердила, использует ли Astra looped transformer.
Почему это важно
Перенос запуска Astra влияет не только на график выхода на рынок, но и на дискуссию о том, как следует контролировать передовые системы искусственного интеллекта. Утверждение о том, что модель использует архитектуру, делающую её внутреннее устройство менее прозрачным, не подтверждено; однако оно усиливает обеспокоенность исследователей в области безопасности возможностями отслеживания попыток модели лгать или обходить меры безопасности. Заявление OpenAI о планах внедрить дополнительные меры мониторинга и ограничения не устраняет противоречие между производительностью и контролируемостью. Главный открытый вопрос заключается в том, окажутся ли протоколы безопасности компании достаточными для своевременного выявления опасного поведения в непрозрачной системе.
Предыстория
OpenAI — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 19 новостей, в которых упоминалось это название; самая свежая датирована 6 сентября 2026 года.