Basetenは、研究部門であるBase Labsを通じて、Hugging FaceおよびGoodfire AIと、オープンウェイトモデル向けの安全性評価・監視基盤を開発する提携と標準規格を発表した。2026年9月17日付の発表では、安全対策を後から追加するのではなく、モデルの訓練および提供のプロセスに最初から組み込むことを目指している。
オープンウェイトモデルは、安全対策を取り除くことができる「abliteration」と呼ばれる技術をめぐって議論を呼んでいる。Hugging Faceでは現在、6,000を超えるabliteration適用モデルが掲載されている。Base Labsは、オープンモデルの訓練と監視のための手法を開発し、公開する。
提携が技術的にどのように機能するのかは明らかにされていない。モデルがどのように判断を下すのかを調査するGoodfire AIは、安全性をモデルに組み込むという目標において役割を担う可能性のある企業として浮上している。AI推論サービスプロバイダーのBasetenは6月、$1.5 billionのSeries F投資を受け、評価額を$13 billionに引き上げた。一方、Goodfire AIは今年初め、B Capitalが主導する$150 millionのSeries B投資を調達した。
Basetenは、フレームワークの開発に貢献してもらうため、開発者エコシステムに公開の呼びかけを行った。同社は、オープンモデルが安全で、誰もがアクセスできるエコシステムの構築を目指していると述べた。
なぜ重要なのか
オープンウェイトモデルでは安全対策を取り除くことが可能であるため、モデルの公開後に講じる対策だけでは十分でない可能性があることが示されている。そのため、開発者、モデルを利用する組織、そしてオープンモデルのエコシステムにアクセスするユーザーにとって、安全性評価をどの段階で、どのような基準に基づいて実施するのかが重要になっている。発表されたアプローチは、アクセシビリティを犠牲にすることなく、安全性をモデル開発プロセスの一部にすることを目指しているが、これを既存モデルの監視にどのように適用するのかはまだ明確になっていない。提携の技術的な仕組みが明らかにされていないため、標準がabliterationを適用したモデルをどのように分類し、リスクをどのように測定し、開発者からの貢献をプロセスにどのように組み込むのかは、未解決の問題として残っている。
背景
Faceは、FikirPilotのアーカイブにおいて新しい名前ではない。過去90日間に、この名前が登場するニュースを8本公開しており、最も新しいものは2026年9月13日付だ。
用語:オープンウェイト
オープンウェイトとは、AIモデルの訓練済みパラメーターをダウンロードできることを指す。訓練データとコードは公開されていない可能性があるため、オープンソースと同じ意味ではない。