豆包输入法上了鸿蒙,我更关心字节在抢什么
今天上午开完周会,电梯里看见一个实习生在手机屏幕上快速点按,嘴里一直在说话。凑近一看,他正在用语音输入回微信,识别速度比我手动打字快得多,标点和停顿基本不用改。我问他用的什么,他说豆包输入法,鸿蒙版,昨天刚上架尝鲜。
我没说话。脑子里转的是另一件事。
版本号0.9.1,尝鲜期一个月,8月22日到9月21日。这个版本号很有意思。0.9.1意味着什么?意味着距离正式版还差一个版本,但字节已经敢把它放到App Gallery上公开招募了。同一时间,iOS和Android版的豆包输入法已经跑了一阵子,功能相对完整,这次鸿蒙版只是把语音识别这个核心能力带了过来,用的是豆包同款语音大模型,支持多方言、英语和中英混输,无网弱网也能用。
说实话,输入法这个赛道,我过去一直觉得是存量博弈。搜狗、百度、讯飞打了十几年,市场格局早就固化了。但今年AI语音识别的能力上了一个台阶之后,输入法这个入口突然重新变得有意思起来。尤其是语音输入这个场景,大模型加持下的识别准确率已经可以做到让人放下键盘,这在我这边团队里已经发生了。上周我们公司内部群聊,有好几个人已经开始用语音输入回消息,包括我自己。
但是豆包这次上鸿蒙,我关心的不只是产品本身。
之前我在写鸿蒙版WorkBuddy那篇帖子的时候提过一个观点:鸿蒙生态的门槛逻辑,真正卡人的不是技术,是意愿和投入产出的判断。对中小开发者来说,鸿蒙适配意味着双倍的人力开销,除非平台能带来明确的增量,否则理性的选择是观望。但字节这种体量的公司不一样,它愿意在版本号0.9.1的时候就拿出一个尝鲜版来,说明它算的是生态卡位的账,不是产品打磨的账。
输入法是什么?是流量入口。是用户每天打开几十次的那个应用。鸿蒙现在的设备量虽然在涨,但应用生态的丰富度和Android/iOS还有明显差距。谁能先在这个生态里占住输入法这个位置,谁就掌握了未来鸿蒙用户打字和说话的第一道入口。这个位置的想象空间不在输入法本身,在后续的AI能力延伸,比如语音助手、AI翻译、跨应用联动。字节显然想把豆包做成鸿蒙生态里AI交互的默认选项。
有意思的是,华为自己有小艺输入法,也有自己的语音助手。但从公开信息来看,小艺输入法在AI能力上并没有给人留下太深的印象。字节这时候进来,是合作还是制衡,其实很难说。对华为来说,引入一个强势的第三方输入法有助于丰富生态,但也相当于把应用层的一部分话语权交了出去。对字节来说,在别人的地基建房子,再好的产品也得遵守平台的规则。这套博弈在移动互联网时代已经发生过一次,现在不过是换了舞台重演。
从创业者的角度看这件事,我有一个更直接的感受。我之前觉得AI能力在加速增长,应用层的机会在于落地和工程化。豆包输入法鸿蒙版就是一个很典型的例子,它没有去追逐什么炫酷的新模型能力,而是把一个已经验证过的语音识别模型,重新打包到一个新平台场景里,提前占坑。这个思路和很多创业公司做产品的方式是反着的。很多团队喜欢先造一个新概念,再想用户在哪里。而字节是看到用户的嘴已经在动了,才决定把产品端过去。
当然,0.9.1这个版本本身还有很多粗糙的地方。双拼用户暂时没得用,手写也没有,键盘皮肤就默认一款。这些都不算致命,尝鲜版本来就是跑通核心链路用的。语音输入这个核心场景做对了,后面慢慢补就行。
下午我又让团队里一个小伙子在鸿蒙开发机上装了豆包输入法试了试。他反馈说识别速度确实快,但有些专业词汇的首选率还有待提高。这个我倒不意外,输入法是个长期调优的活,数据积累比模型本身更值钱。字节在流量和用户数据上有天然优势,这块正是它的护城河。
我现在的判断是,豆包输入法鸿蒙版这步棋,字节下得很稳。它没有抢首发,也没有等到功能全齐了再上,而是选了一个中间节点,用尝鲜的方式把核心能力先摆上台面,剩下的交给用户反馈和数据迭代。对鸿蒙生态来说,这是一个信号:大厂开始认真对待这个平台了,而且是从最刚需的入口应用开始。
往后看一年,随着HarmonyOS NEXT的设备量继续爬坡,这种头部应用以尝鲜版切入、再快速迭代的玩法会越来越常见。对于中小团队来说,与其纠结要不要现在就全面适配鸿蒙,不如先看看自己所在的赛道有没有被大厂盯上。如果字节们在某个入口赛道已经动手了,这个赛道留给创业者的窗口期就不多了。要么找到他们覆盖不到的垂直场景,要么就别硬挤了,但输入法这种通用入口,我看悬。
物界前沿