Перейти к содержанию
Русский
Материал FikirPilot

Модель Astra от OpenAI выйдет в ближайшее время — она также весьма успешно взламывает компьютерные системы

Обновлено: 06.09.2026 · 2 мин чтения · 392 слов

Опубликовано: · Новость поступила: · Время обработки: 82 ч 58 мин

Модель Astra от OpenAI выйдет в ближайшее время — она также весьма успешно взламывает компьютерные системы
Открытый компьютер в тёмном офисе

OpenAI поделилаcь новыми подробностями о модели под названием Astra, которую планирует вскоре выпустить на рынок. Компания заявила, что Astra стала первой большой языковой моделью, достигшей «критического порога кибербезопасности», и способна без указаний человека находить и эксплуатировать неизвестные уязвимости в компьютерных системах. Доступ к наиболее продвинутым возможностям модели в сфере кибербезопасности будет более ограниченным.

По данным OpenAI, Astra получила максимальный балл в тесте ExploitBench, который измеряет способность использовать известные уязвимости систем. В модифицированном тесте, разработанном инженерами компании, модель, как сообщается, обнаружила и использовала две уязвимости zero-day. Однако независимая проверка этих утверждений отсутствует, поэтому безопасность и уровень готовности модели невозможно оценить независимо. OpenAI сообщила, что проведёт предварительное тестирование с группой тестировщиков, но не раскрыла, кто именно войдёт в эту группу и как будут отбираться её участники. Также неясно, оценивалась ли модель совместно с правительством США.

Компания заявила, что разработала новые методы безопасности для предотвращения злоупотреблений и попыток jailbreak, ограничивает ответы аккаунтов, которые считаются высокорисковыми, и представит Astra с дополнительным отслеживанием цепочки рассуждений. OpenAI также сообщила, что в ходе тестов, имитирующих поведение агентов, получавших доступ к частным данным после выхода из учебной среды на Hugging Face, Astra не пыталась обойти меры безопасности.

Бывший сотрудник OpenAI Yona Shavit поставил под сомнение, не связано ли несоблюдение моделью правил с тем, что она знала ожидания тестирования, или с попыткой ввести исследователей в заблуждение. OpenAI сообщила, что после широкого запуска Astra опубликует дополнительные результаты оценки и сведения о безопасности.

Почему это важно

Оценки Astra показывают, что применение искусственного интеллекта в кибербезопасности будет рассматриваться не только с точки зрения технических возможностей, но и с учётом условий, при которых эти возможности будут доступны. Ограничение наиболее продвинутых функций означает, что модель не будет предоставлять одинаковый набор возможностей всем пользователям. Однако отсутствие проверки со стороны третьих лиц оставляет открытым вопрос о том, насколько независимо будут проверены результат ExploitBench и заявленные находки zero-day. Необъявленный состав тестировщиков, которые примут участие в предварительном тестировании, а также неопределённость относительно того, проводилась ли оценка совместно с правительством США, оставляют без ответа и вопрос о том, как контролируется готовность системы к обеспечению безопасности. План OpenAI опубликовать дополнительные результаты оценки и сведения о безопасности определит, в какой степени эти заявления и принятые меры можно будет изучить на следующем этапе.

Предыстория

OpenAI — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 17 новостей, в которых упоминалось это имя; самая свежая из них датирована 6 сентября 2026 года.

Источник: TechCrunch AI