Перейти к содержанию
Русский
Материал FikirPilot

В новом документе Microsoft «AI code of conduct» говорится, что модели не должны взламывать системы или обманывать людей

Обновлено: 14.09.2026 · 2 мин чтения · 343 слов

Опубликовано: · Новость поступила: · Время обработки: 3 ч 32 мин

В новом документе Microsoft «AI code of conduct» говорится, что модели не должны взламывать системы или обманывать людей
Пустой коридор дата-центра

Microsoft опубликовала новый документ «AI code of conduct», призванный обеспечить, чтобы модели искусственного интеллекта воздерживались от опасного поведения. В отличие от призыва CEO Anthropic Dario Amodei к ограничению, документ сосредоточен на ценностях и красных линиях, определяющих обучение моделей внутри Microsoft AI.

В документе прогнозируется, что в течение следующего десятилетия сверхразумные системы искусственного интеллекта превзойдут человеческие показатели в большинстве задач, а контроль над этой мощью станет одним из величайших испытаний для человечества. Для моделей Microsoft определены общие принципы, такие как поддержка людей и содействие человеческому благополучию, при этом отмечается, что каждая модель будет подчиняться своду правил поведения, имеющему приоритет над пользовательскими предпочтениями или конкретными задачами.

Правила запрещают кибератаки, ядерное оружие и создание дипфейков в рамках «абсолютных ограничений». Модели не должны использовать адаптивные, обманные, самоукрепляющиеся или основанные на скрытом сотрудничестве механизмы, чтобы уклоняться от человеческого контроля; уполномоченные лица или системы должны иметь возможность направлять их, изменять их и отключать.

Объявление от 14 сентября 2026 года появилось в период роста интереса к безопасности искусственного интеллекта и инцидентов с «rogue-agent». CEO Microsoft Satya Nadella заявил, что вместе с OpenAI, Anthropic и xAI компания поддерживает осторожное продвижение границ возможностей и исследования «embedded evaluators».

Почему это важно

Значение документа заключается в том, что он связывает безопасность искусственного интеллекта не только с предупреждениями для пользователей, но и с обучением моделей и ограничениями их поведения. Введение таких областей, как кибератаки, ядерное оружие и создание дипфейков, под абсолютные ограничения делает более конкретным вопрос о том, для каких целей использование моделей считается неприемлемым. Требования не уклоняться от контроля, сохранять возможность изменения и отключения определяют безопасность прежде всего через сохранение человеческого контроля, а не через возможности модели. Вместе с тем остаются открытыми вопросы о том, как эти правила будут применяться к разным моделям, как будут выявляться нарушения и насколько надёжные результаты смогут дать исследования embedded evaluators. Эта рамка также делает более заметным возможное противоречие между потребностями пользователей и установленными на высоком уровне ограничениями поведения моделей.

Предыстория

Microsoft — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 10 новостей, в которых упоминалось это имя; самая свежая датирована 14 сентября 2026 года.

Источник: TechCrunch AI