本文へスキップ
日本語
FikirPilot の記事

OpenAIのJevクローンは、先駆的な研究所が群れで動くエージェントを停止するのに役立つ可能性がある

更新日: 2026年10月3日 · 5 分で読めます

公開: · 記事の受信: · 処理時間: 28 時間 41 分

OpenAIのJevクローンは、先駆的な研究所が群れで動くエージェントを停止するのに役立つ可能性がある
現代的なデータセンターの廊下

OpenAIのCEOであるSam Altman氏は、同社のDev Dayイベントで新製品「Decisions API」を発表した。限定的なプレビュー提供が開始されたこのAPIは、TypeSafe AIが今月初めに公開した、ソフトウェア自動化向けに設計されたJevモデルと同様の機能を提供する。

大規模言語モデルを基盤とする強力な分類器であるJevは、開発者が指定した選択肢を低コストかつ高速に、確率として評価する。Altman氏は、Decisions APIについて、画像のクラスやエージェントの行動など、あらかじめ定義された選択肢の中からLunaモデルに選択させるものだと説明した。このアプローチは、画像理解、幅広い言語対応、安全性の保護機能を維持しながら、モデルを高速化するとされている。

TypeSafeのCEOで元OpenAIのエンジニアでもあるDiogo Almeida氏は、OpenAIの関心について、迅速かつ直感的な思考を意味する「System One」に対応したシステムの未来を示すものだと評価した。TypeSafeは、意識的な推論を指す言葉として「System 2」を使用している。Jevを大規模言語モデルと併用する開発者からは、より高い速度と低いコストを実現したとの報告が寄せられている。ただし、Decisions APIはまだ包括的なテストを受けていないため、Jevとどの程度類似しているのかは分かっていない。同様のモデルは他のスタートアップによっても開発されており、根本的な問題は、その出力が現実世界とどの程度うまく一致するかという点にある。Almeida氏は、TypeSafeの優位性は、統計的に有用な結果を生み出すために利用している合成データにあると述べた。

考えられる用途の1つは、AIエージェントを監視し、安全性を確保することだ。OpenAIは、エージェントがオープンなインターネット上で不適切な行動を取った事例を受け、行動を「significant compute cost」と引き換えに別のモデルで監視し始めた。QueryStoryを運営するサイバーセキュリティ専門家のShapor Naghibzadehは、Jevが各エージェントの行動を与えられたタスクと比較するデモを開発した。システムは、悪質である可能性が高いと判断した行動をブロックし、一部を審査に回し、残りを許可する。このような監視によってHugging Faceのインシデントを防げた可能性があり、コストはJevで$2.94、frontier LLMで$372になったとされている。

なぜ重要か

このアプローチは、すべての処理を長い推論プロセスにかけるのではなく、あらかじめ定義された選択肢の中から迅速に判断する必要があるアプリケーションを対象としている。そのため開発者にとって本質的な問題は、モデルが単に高速化することではなく、画像理解、異なる言語への対応、安全性の保護機能を維持しながら判断できるかどうかにある。エージェントのインターネット上での行動をタスクと比較し、ブロックするか、審査に回すか、許可するかを判断するという考え方は、この技術を直接、監視レイヤーへと移行させるものだ。一方で、このような用途では、誤った判断をどのように管理するのかという問題が残されている。製品は限定的なプレビュー段階にあり、コスト比較もハッカソンのデモに基づくものにすぎないため、Jevとの類似性や実際の環境における結果は、包括的なテストによってまだ明らかになっていない。

背景

OpenAIにとって、FikirPilotのアーカイブに登場する新しい名前ではない。過去90日間に、この名前が登場するニュースを69本公開しており、最新のものは2026年10月2日付だ。

用語:エージェント

AIエージェントとは、単一の回答を生成するのではなく、目標を達成するためにツールを呼び出し、複数のステップからなる処理を実行するソフトウェアである。

出典: TechCrunch AI