社区讨论 · 政策
豆包2.2延期,晚发点真不丢人
这年头大模型发布比手机跳票还快,原计划8月推2.2,结果推迟,第一反应是字节也扛不住宣传节奏了。但仔细想,这反而可能是好事。
现在模型最怕新能力不稳。编程、工具调用、Agent这些东西,演示看着很神,真接到自己业务里,经常一句话没理解清楚就乱调接口,或者循环里把上下文吃没了。
接近字节的人士说,延期是为了更充分的预训练和后训练,把编程、工具调用和Agent能力补扎实。之前豆包2.0发布时主打的就是支撑亿级用户执行复杂任务,方向已经摆得很明白,要做能干活的产品。可干活这件事,最怕半吊子。
尤其是Agent,会写规划还不够,得会看结果、会纠错、会在没权限时闭嘴。我这一阵拿API跑小工具,也有点体感。模型能不能把一段脏数据清洗完只是第一步,更关键的是它能不能稳定地按步骤调用工具、失败后知道回退、长任务里不把自己绕死。很多版本发布会看起来很强,跑个分看看还行,真接到工作流里,一上午能给你整出三四个低级错误。
这类延期以前也常见。发布会一拖,外界容易觉得掉队,但模型这东西,早发未必更好。尤其面向企业和个人工作流,一次乱调用、一次权限误操作,比跑分差一点更伤信任。所以这次延期,如果字节是在补稳定性,那就晚几周也值。大模型市场现在不缺一个按时发布的版本号,缺的是少画饼、少返工。要是后面2.2真能把Agent和工具调用做顺,这波推迟更像补课。
晚发不怕,怕的是发得早,用户还得替它测问题。
物界前沿