Amazon Web Services(AWS)发布了面向人工智能代理决策步骤的开源模型 Strands Decider 2B。该模型受 TypeSafe 的 Jev 模型启发,不生成文本,而是在预先定义的选项之间进行选择,并为其决策附加置信度分数。该模型体积小巧,足以在本地设备上运行,基于 Qwen3.5-2B 构建。该模型定位于有限任务,例如让代理根据自身所处的状态选择下一步操作。
这个由 AWS 工程师 Marc Brooker 开发的实验性项目,曾短暂登上其尺寸类别的 Jevbench 排行榜首位,随后在 Strands Labs 旗下发布。与 AWS 客户的沟通表明,在简单步骤中使用大型模型会增加延迟和成本。
Jev 发布之后,已开发出数十个类似模型;OpenAI 本周也发布了 Decisions API。TypeSafe CEO Diogo Almeida 则表示,真正的挑战在于让模型变得实用且智能,目前阶段他们并未看到激烈的竞争。分析认为,小型决策模型在路由、分类和选择下一步行动等狭窄任务中,可能在成本和延迟方面带来优势。
为何重要
随着人工智能代理的普及,在每一步都调用大语言模型所带来的成本和缓慢正变得愈发明显;AWS 在客户沟通中呈现的这一局面表明,将决策工作转移到独立且低成本的一层,这一想法源于实际需求。OpenAI 在同一周发布 Decisions API,以及 Jev 之后涌现出数十个类似模型,令人认为专注于狭窄任务的决策模型并非一次短暂的实验,而是正在演变为大型厂商也纷纷布局的新竞争领域。这一进展最关系到开发基于代理的软件的团队,以及希望在设备上运行对延迟敏感的应用的人,因为该模型开源且可本地运行,使人们能够在不依赖云的情况下进行试验。悬而未决的问题则集中在 TypeSafe CEO 指出的这一点上:尽管在选项之间进行选择看起来在技术上已经解决,但这些模型在实际产品中会有多实用、表现得多智能,目前尚未得到证明。
背景
Amazon 在 FikirPilot 档案中并非新名字:过去 90 天里,我们发布了 12 篇提及这一名字的报道;最新的一篇日期为 2026 年 10 月 2 日。
术语:代理
人工智能代理是一种不生成单一回复,而是为达成目标调用工具并执行多步骤任务的软件。