物界前沿 · 资讯情报卡(IT之家 · 2026/9/7)
腾讯混元Hy4 preview模型优化降低Token消耗
核心事实
- 腾讯混元与WorkBuddy团队联合优化Hy4 preview模型,已全量上线。
- 针对复杂任务中长思考及过度自我验证问题进行了专项技术改进。
- 优化后在保持任务效果不变前提下,显著减少任务轮次和Token用量。
- 该模型于8月28日发布,总参数770亿,激活参数49亿。
关键数据
770 B总参数
49 B激活参数
1M上下文长度
物界观察
此次更新直击大模型应用痛点:推理成本过高。通过算法层面抑制无效“内耗”,在不牺牲性能下大幅压缩Token,意味着企业部署门槛降低。这标志着开源模型竞争从单纯堆参数转向追求推理效率与经济性平衡,利好实际落地场景。
来源:IT之家原文 ↗
物界前沿