Baseten объявила о партнерстве и стандарте, в рамках которых через свое исследовательское подразделение Base Labs будет совместно с Hugging Face и Goodfire AI разрабатывать инфраструктуру для оценки безопасности и мониторинга моделей с открытыми весами. В заявлении от 17 сентября 2026 года говорится, что цель инициативы — с самого начала встраивать меры безопасности в процессы обучения и развертывания моделей, а не добавлять их впоследствии.
Модели с открытыми весами вызывают споры из-за техники под названием «abliteration», которая позволяет удалять меры безопасности. В настоящее время на Hugging Face представлены более 6 000 моделей, к которым была применена abliteration. Base Labs будет разрабатывать и публиковать методы обучения и мониторинга открытых моделей.
Не сообщается, как именно технически будет работать партнерство. Goodfire AI, изучающая способы принятия решений моделями, выделяется как компания, которая может сыграть роль в реализации цели по встраиванию безопасности в модели. Baseten, поставщик услуг ИИ-инференса, в июне привлекла $1.5 миллиарда в рамках Series F, увеличив свою оценку до $13 миллиардов. Goodfire AI в начале этого года привлекла $150 миллионов в рамках Series B под руководством B Capital.
Baseten открыла экосистеме разработчиков приглашение внести вклад в развитие фреймворка. Компания заявила, что стремится создать экосистему, в которой открытые модели будут безопасными и доступными для всех.
Почему это важно
Возможность снятия мер безопасности с моделей с открытыми весами показывает, что меры, принимаемые после публикации модели, сами по себе могут быть недостаточными. Поэтому для разработчиков, организаций, использующих модель, и пользователей, получающих доступ к экосистеме открытых моделей, приобретает значение вопрос о том, на каком этапе и по каким критериям будут проводиться оценки безопасности. Объявленный подход призван сделать безопасность частью процесса разработки модели без отказа от доступности; однако пока неясно, как это будет применяться к мониторингу существующих моделей. Поскольку технический механизм партнерства не раскрыт, остаются открытыми вопросы о том, как стандарты будут классифицировать модели, к которым применена abliteration, как будут оценивать риски и каким образом вклад разработчиков будет интегрирован в этот процесс.
Предыстория
Face — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 8 новостей, в которых упоминалось это имя; самая свежая датирована 13 сентября 2026 года.
Термин: открытые веса
Открытые веса означают, что обученные параметры модели искусственного интеллекта доступны для скачивания; это не то же самое, что открытый исходный код, поскольку данные для обучения и код могут оставаться закрытыми.