5万星背后,DeepSeek Harness的插件化是Agent的安卓时刻
我注意到一个有意思的细节:DeepSeek Harness这个仓库,发布一个半小时破2万星,12小时过了5万。什么概念,他们自家R1破2万星用了5.7天,Grok-1当时用时极短就被叫“史上最快”了,这次直接按小时算。这个速度不太正常,已经不是技术圈的自嗨能解释的。
数据只是一面,真正让我觉得值得琢磨的是社区往里装了什么。长期记忆、浏览器、数据库、任务管理,这些还算正经。有人嫌DeepSeek不会看图,现场接了个视觉模型进去。再往下画风就不对了,电子宠物、像素鲸鱼、4399小游戏。我昨天看到还有人往里塞了个养成类的插件,给模型喂东西吃。画风虽然放飞,但你把这一摞插件拉通看,其实只干了一件事:把Agent从“对话框里的聊天机器人”变成“自己能长东西的平台”。
这个事放在估值框架里看,路径就清楚了。
先说我自己的使用体感。我大概一周前开始用Trae,同一天开始摸WorkBuddy,这两天的重心在试Astra,刚上手。工具用多了有个感受,现在所有的Agent产品都在抢同一个东西:你愿不愿意把日常任务托管给它。但托管的前提是信任,信任的前提是它得懂你的数据、你的习惯、你的上下文。DeepSeek Harness给出的是另一个解法:我不替你做所有事,但我给你一根足够长的线,你自己去织网。长期记忆、视觉能力、工具调用,全是插件,装什么你说了算。
这才是“不想做下一个Codex”这句话的底气,也是它和Astra这种产品路线差异的关键。
Astra走的是端到端,OpenAI把能力做成完整产品,你拿来就用,但用成什么样取决于OpenAI想让你用什么。Harness反过来,给自己的定位是一个壳,模型、工具、会话、技能、UI全是插件,Cordis就是那个底座。这个架构上的分野,放到竞争格局里看,像极了当年iOS和Android的分岔。Astra是iOS,体验统一,供应链高效;Harness是Android,碎片化,但生态野蛮生长。你问我想押哪个,我押Android那个方向。原因很简单,Agent这个品类的使用场景太碎,没有任何一家公司能替所有用户定义清楚什么叫“有用”。
不过话说回来,社区的热闹和产品的成熟是两回事。我在GitHub的讨论区看到一个反馈,有人说Harness大部分功能都不错,但搜索能力有问题,信息经常滞后。同一个人拿它做DeepSeek旗舰模型的介绍页,Flash Max做出来的是V3.2,Pro Max做出来的内容更新一些。这是Harness眼下的真实状态:框架的想象力比单点能力走得快,插件化解决了“能不能扩展”,但没解决“默认能力够不够强”。
这个我要单独说一下。插件化的好处是生态帮你补短板,但它有一个前提,就是核心底座得足够强。如果默认模型的能力不行,插件装得再多也是给一个不够聪明的脑子接肢体。从目前的内测反馈看,Harness的插件系统本身是及格的,但搜索、信息新鲜度这类基础能力还有明显的坑。好消息是这些坑属于“可修”范畴,坏消息是修这些坑的速度决定了Harness能不能把5万星的关注度留成用户。
从估值角度想,我觉得这个项目真正的价值不在DeepSeek自己的股价上,毕竟人家没上市,而在于它给整个行业提供了一个观察窗口。Agent赛道的估值逻辑以前是拼参数、拼算力、拼谁的模型大,现在多了一个变量:拼生态。Harness用插件化的方式把生态的门槛打下来了,一个普通开发者不需要懂模型训练,不需要懂推理优化,会写个简单的插件就能让Agent多一个器官。这个门槛的降低,意味着Agent的供给端从大厂扩散到了全世界的独立开发者,这个变化在过去的移动互联网时代被验证过一次。
今天的疯狂装插件,就是当年的“There‘s an app for that”。
物界前沿