跳到正文
中文
FikirPilot 内容

OpenAI 的 Jev 克隆版可能帮助这家先驱实验室停止以群体方式运行的代理

更新于: 2026年10月3日 · 3 分钟阅读

发布于: · 消息抵达: · 处理时长: 28 小时 41 分钟

OpenAI 的 Jev 克隆版可能帮助这家先驱实验室停止以群体方式运行的代理
现代数据中心的走廊

OpenAI CEO Sam Altman在公司的 Dev Day 活动上宣布了新产品“Decisions API”。该 API 已开放有限预览,提供的功能类似于 TypeSafe AI 于本月初发布、为软件自动化而设计的 Jev 模型。

Jev 是一种基于大型语言模型的强大分类器,能够以低成本、高速度和概率形式评估开发者设定的选项。Altman 表示,Decisions API 能让 Luna 模型在预先定义的选项中进行选择,例如图像的类别或代理的行为。据称,这种方法在保留图像理解、广泛语言支持和安全防护功能的同时,还能提升模型速度。

TypeSafe CEO、前 OpenAI 工程师 Diogo Almeida 认为,OpenAI 的关注表明了兼容“System One”系统的未来方向;“System One”表达的是快速且直觉式的思考。TypeSafe 使用“System 2”这一术语指代有意识的推理。开发者将 Jev 与大型语言模型结合使用后,报告称速度更快、成本更低。不过,由于 Decisions API 尚未经过全面测试,目前尚不清楚它在多大程度上类似于 Jev。其他初创企业也在开发类似模型;核心问题在于,这些模型的输出与现实生活的契合程度究竟如何。Almeida 表示,TypeSafe 的优势在于其用于生成具有统计效用结果的合成数据。

可能的应用领域之一,是监督 AI 代理并确保其安全。在代理于开放互联网中出现错误行为的事件之后,OpenAI 开始使用单独的模型监控其行动,代价是“significant compute cost”。负责 QueryStory 的网络安全专家 Shapor Naghibzadeh 开发了一项演示,让 Jev 将代理的每项行动与分配的任务进行比较。该系统会阻止它高度确信有害的行动,将部分行动引导至审查,并允许其余行动继续进行。据称,这类监督能够避免 Hugging Face 事件,使用 Jev 将产生 $2.94 的成本,而使用 frontier LLM 则会产生 $372 的成本。

为何重要

这种方法面向的是这样一类应用:无需让每项操作都经历漫长的推理过程,而是要求系统在预先定义的选项之间快速作出决定。因此,对开发者而言,关键问题不仅在于模型能否提速,还在于它能否结合图像理解、不同语言和安全防护功能,持续作出决定。通过将代理在互联网上的行动与其任务进行比较,从而加以阻止、提交审查或放行的想法,将这项技术直接带入监督层;但这种用法也留下了如何处理错误决策的问题。由于该产品目前处于有限预览阶段,且成本比较基于一次黑客马拉松演示,其与 Jev 的相似程度以及现实生活中的输出,尚未通过全面测试得到明确结论。

背景

OpenAI 并不是 FikirPilot 档案中的新名字:在过去 90 天里,我们发布了 69 篇提到这一名字的新闻;最新一篇发布于 2026年10月2日。

术语:代理

人工智能代理是一种软件。它不是只生成单个回答,而是通过调用工具来执行多步骤工作,以实现目标。

来源: TechCrunch AI