社区讨论 · 赛道

Codex和Claude Code到底谁好用,我用一周说了不算

导师说对导师说对8月22日2026/08/22 317 浏览

作为一个写代码全靠改师兄旧脚本的科研狗,我试了一下把Codex和Claude Code扔进同一个项目里互相对打。起因是看到新闻说Codex周活跃用户冲到2000万,评论区已经有人喊「Claude Code要完了」。我导师上周还在用Claude Code改实验代码,这周就有人跟他说要换,他让我试一下再给他结论。

第一天装Codex,用的CLI版本。装倒是简单,一条命令的事,但配置的时候卡住了。我在实验室的服务器上跑,代理没设对,认证一直超时,折腾了快四十分钟才反应过来是环境变量的问题。这块体验和Claude Code差不太多,我第一次配Claude Code的时候也栽在代理上,属于两个都有的坑。不过Codex有个让我意外的点,它的CLI里直接能切模型版本,不用改一堆配置。我这边实验室机器比较老,CPU跑推理基本指望不上,全靠调API,这个切换确实省事。

头两天主要在跑一个强化学习的基准测试库,代码量不大但逻辑绕。我把需求写清楚丢给Codex,它给出的方案在思路上比Claude Code更接近我自己会写的做法,尤其是设计奖励函数的时候,它的推理路径明显更长,会先解释为什么这么设,再动手写。但代码风格是真的糙,注释没几句,变量名起得随意,有一处循环边界还是错的,我花了一段时间才定位到。同样是这个任务,Claude Code写出来的代码干净多了,函数拆得清晰,每段都有注释,拿去给师弟师妹做入门材料完全没问题。

第三天开始让它俩干同样的活,我统计了一下需要返工的比例。这边测下来,Codex在逻辑推理类的问题上,比如「这个环境里状态转移为什么会发散」,一次就给对的概率更高。但它给的代码放进项目里之前,我总是得先自己过一遍格式和边界条件。Claude Code更像是那种听话的助手,你给它规范它就按规范来,很少出格,可一旦问题本身不明确,它就容易按自己的理解想当然,返工基本都栽在这种地方。

一周用下来,我的感觉是这俩真的不像是在同一个赛道上。这么说吧,Claude Code给我的感觉是帮我把代码写干净,它在项目里的定位更像一个严格的结对同事,会盯着代码风格和可读性。Codex则是那种解题型选手,遇到复杂问题它能给你绕出来一条路,但路上坑坑洼洼它不太管。还有一件事让我有点意外,OpenAI出了个插件,能让Codex直接跑到Claude Code里面去当第二道审查,专门挑Claude Code产出代码里的bug。我试了一下,这招确实有点用,两个模型互相挑刺的时候,比任何一个单独干都让人放心。

有个数据我觉得更值得注意,Anthropic的收入大头其实还是靠API卖模型给Cursor、GitHub Copilot这些产品,自家的Claude Code更像是一个展示窗口,顺便收集真实反馈。OpenAI这边明显是铁了心要把Codex做成入口产品,连抢占别人桌面的插件都出了。不管是谁在终端里赢了,最后卖铲子的还是模型本身的调用量。

我现在给导师的建议是,别急着换。如果你主要写业务代码、API调用、前端页面这类工程活,Claude Code的代码质量优势很明显。如果你跟我一样,经常要处理那种「想了半天不知道为什么会这样」的问题,Codex值得留一个备用。

不过我也在想一件事,这俩现在互相抄功能抄得飞起,等再过半年,它们的差别还会像现在这么明显吗?这个问题我暂时没有答案,但至少这周我把该测的测了,代码倒是留下了不少,也算没白折腾。

0 条回复

?
Ctrl + Enter 快速回复
还没有回复,来抢沙发吧