Tencent 开源发布了新一代大语言模型 Hy4 Preview。该模型专注于编码、办公应用和科学研究,拥有770十亿个参数;采用 Mixture-of-Experts 方法后,每次处理会激活49十亿个参数。其上下文窗口超过1百万个 token。
在 Tencent 通过163名专家和203项工程任务开展的盲测中,Hy4 Preview 得分为2.99(满分4分);Kimi K3 得分为2.94,GLM-5.3 则为2.92分。该公司表示,结果基于其内部评估。
该模型可用于长上下文软件开发、数据和财务分析、文档、电子表格和演示文稿生成、游戏原型创建以及科学问题求解。Tencent 还表示,Hy4 Preview 为训练、数据、评估和算子优化作出了贡献,通过解决自身基础设施中的瓶颈,使端到端能力提升了31.8%。
该模型可通过 WorkBuddy、CodeBuddy、Yuanbao、ima、Tencent Cloud TokenHub、OpenRouter 和 Hugging Face 提供。API 价格为每1百万个输入 token 0.834美元、每1百万个输出 token 2.501美元;通过缓存使用的每1百万个 token 价格为0.042美元。
为何重要
Hy4 Preview 的开源发布,使该模型不再只是局限于 Tencent 自有产品的服务,而成为开发者和研究人员可以在不同使用场景中进行研究的一种选择。超过1百万个 token 的上下文容量,使模型尤其能够帮助处理长期软件项目、全面文档和大型数据集的团队在单次处理中处理更广泛的内容。通过 WorkBuddy、CodeBuddy、Tencent Cloud TokenHub、OpenRouter 和 Hugging Face 提供访问,同时公布 API 价格,使人们能够在评估使用决策时,除了考虑技术特性,也将成本纳入考量。不过,由于性能优势的说法基于 Tencent 自身的内部盲测,因此在不同的独立评估中能否得到相同结果,仍有待观察。