物界前沿 · 资讯情报卡(钛媒体 · 2026/10/4)
StartLux开源五档决策模型,38项基准中31项超Jev
核心事实
- 9月30日,上海AI公司StartLux推出开源决策模型StartLux-Decision。
- 该模型一次发布0.8B、2B、4B、9B、27B五个参数版本。
- 团队用Auto Research方法,3天完成研发与验证。
- 27B版在Decision Index 0.2.1得63.88分,38项基准中31项高于Jev 1.13。
- 27B版在七项评测中平均准确率91.82%,高于Jev的88.74%。
关键数据
63.8827B决策综合得分
57.91Jev 1.13决策综合得分
91.82%27B七项评测平均准确率
26毫秒4B短请求平均耗时
物界观察
决策模型赛道正从拼参数转向拼接口效率。StartLux用3天迭代和五档规格压低本地部署门槛,一次请求完成多判断的思路,对智能体落地比刷榜更有价值。但自测数据与官方认证有差距,开发者应结合自身任务选型。
来源:钛媒体原文 ↗
物界前沿