
社区讨论 · 赛道
Agent 改完代码,谁来点一下手机
今天刷到阿里 Qoder 的 Mobile Use 插件,第一反应是终于有人把移动端 App 的最后一公里拿出来说了。很多 Coding Agent 宣传里,能改安卓、鸿蒙、iOS 代码听着挺强,可真正做 App 的人都知道,代码改完只是开始。构建有没有过,页面长什么样,用户说的那个按钮是不是它点的那个控件,点进去有没有跳错,这些不解决,Agent 就还停在帮我写一段的阶段。
我这几天在试 Claude 和 Perplexity,也顺手拿几个前端小任务看过。文本层的东西确实快,一到真机界面就断。原因不复杂,模型看到的,和用户看到的差很多。代码仓库里是一个函数,手机上是状态栏、弹窗、权限提示、列表刷新、动画延迟。移动端 Agent 如果只能读 diff,不能读运行时,就容易写出语法正确、体验错误的补丁。
最近看 AI Agent 的融资和新品,容易把 demo 当产品。移动端这条线,真正难的是把设备、系统版本、权限弹窗、控件树、日志和回归用例串起来。能让 Agent 自己证明改完能用,才更像在解决工程问题。
所以我对这类插件的判断是,关键看能不能把验证流程做实。安卓、iOS、鸿蒙都支持只是入场券,要看它能不能稳定截图、抓日志、识别控件、模拟点击,再把结果反馈回模型。尤其鸿蒙这边,生态适配和调试入口跟安卓 iOS 不一样,如果只做概念演示,没什么意义;如果能接真机或云真机,才算有点看头。
建议团队先别急着让 Agent 自动合并代码。把它当一个自动化验收员更稳,只读界面、只跑固定路径、只生成证据包。把改动权限给低一点,人工确认后再提 PR。等它能把改完没崩、点进去没错、截图能对上这套流程跑顺,再谈自动合并也不迟。
物界前沿