跳到正文
中文
FikirPilot 内容

Google表示,新Gemini 3.8 Flash模型“works harder”,但成本可能更高

更新于: 2026年9月5日 · 3 分钟阅读

发布于: · 消息抵达: · 处理时长: 71 小时 8 分钟

Google表示,新Gemini 3.8 Flash模型“works harder”,但成本可能更高
现代数据中心走廊

Google 在前一款模型上市几周后推出了 Gemini 3.8 Flash。该公司表示,这款模型在复杂任务中会采取更多推理步骤,并反复使用工具。其起始价格与 Gemini 3.7 Flash 相同:每百万输入 token 0.75 美元,每百万输出 token 3.75 美元。不过,Google 警告称,为了提升性能,尤其是在高努力程度下,模型可能会使用更多 token。希望减少 token 消耗的开发者仍可继续使用 Gemini 3.7 Flash。

Artificial Analysis 表示,在这一智能水平上,该模型是其测得的最便宜选项;由于每项任务的输出 token 增加了 30%,且处理轮次更多,其成本相比 Gemini 3.7 Flash 约上升了 40%。Google 表示,该模型在软件工程和自主人工智能代理方面取得了重大进展,并在 DeepSWE v1.1、Vals Finance Agent V2 和 Harvey’s Legal Agent 测试中击败了竞争对手。该模型配备了防止在 CBRN 和网络攻击领域被滥用的安全措施。

Gemini 3.8 Flash Cyber 通过 Fairwind Program 提供,该计划拥有 650 名成员,仅向政府和可信合作伙伴开放。该计划还提供对 CodeMender 工具的访问权限。消费者、开发者和企业用户均可使用 Gemini 3.8 Flash。

为何重要

对开发者而言,核心变化在于,在保持相同输入价格的同时,复杂任务中的处理强度可能会推高总成本。因此,模型选择不再只取决于单位 token 费用,还取决于任务需要多少输出 token 和多少轮处理;对于希望降低消耗的用户,上一版本仍然是一个选项。软件工程和自主代理测试中的结果,为评估团队在这些领域使用该模型提供了比较依据;不过可以看出,其中一部分性能数据来自 Google 自己的说明。网络安全版本仅向一个有限计划开放,则将其访问范围与普遍使用区分开来,也留下了这一专用版本将由哪些人、在什么条件下使用的问题。

背景

Google 在 FikirPilot 档案中并不是一个新名字:过去 90 天里,我们发布了 24 篇提及这一名称的新闻;最新一篇发表于 2026年9月5日。

来源: The Verge