别追最便宜模型,先搭个性价比账本
跟进高性价比 AI 模型,不用每天刷帖,做一张会过期的账本。很多人问怎么跟上最省钱的模型,价格、任务质量和 token 计量会一起变,需要一套复查流程。
上周我写过追 Bel 模型,这次把它改成价格追踪。我用了不到一周的 Claude Code 和搜索 agent,对比了两种方案。方案一是人肉刷 X、IT之家和价格页,找当前适合 coding 的低价模型,大约二十分钟,还漏掉一个限时价。方案二是让搜索 agent 把几个价格追踪页拉成时间线,几分钟出了候选。它在输入 `列出适合 coding、输出价低于 $5/1M 的模型,并标注更新时间` 后,给到 Gemini 3 Flash 输出约 $0.50/1M、DeepSeek V3 约 $0.27,Claude Sonnet 5 限时 $2/$10,到期 $3/$15。但我仍要点回页面看更新时间。
先搭账本。新手别急着问“哪个模型最便宜”。打开飞书表格,建七列 `模型`、`输入价`、`输出价`、`是否限时`、`上下文长度`、`我的质量线`、`最后核对日期`。token 是 AI 的计量单位,输入价是喂进去的钱,输出价是它回答吐出来的钱。上下文长度是一次能记住多少对话材料,越长不一定越省钱。代码任务通常输出更长,输出价更敏感。
在表旁边写三个任务,改代码、读长文档、中文润色。给每个任务定一个底线,比如低于 3 分就淘汰。aicost 那类页面也建议,先定质量线,再找满足质量线里最便宜的。
实际跑一遍。去 ModelPicker 或 AI Cup 这种聚合页,点 `Coding`,在筛选框输 `output price < 5`,看到一张表或散点图,预期得到三五个候选。把模型名和价格抄进账本。然后算一笔小账,假设一个月输入 50 万 token,输出 10 万 token,Sonnet 5 限时价成本约 $2,到期后约 $3;如果代码 token 还涨 10% 到 35%,实际支出还会往上走。我这边拿一个改 Python 脚本的活试了三个模型,便宜的 DeepSeek 输出快但注释风格不像我要的,Gemini 3 Flash 在短改上够用,复杂多文件还是贵一档更稳。
踩坑也在这里。一个坑是只看输入价,忽略输出价,很多模型输入很便宜,生成代码时输出价把账拉爆。另一个是把 agent 的话当结论,它可能只抓到快照,没看到“限时结束”或 tokenizer 变化。还有一个是上下文长度越大不一定越省钱,长文档喂得越多,输入价越高。我的解法是每列留来源,每周五复核一次。
学完这个,下一步可以拿最近一周的 AI 订阅账单,填出输入输出 token,再选两个候选模型,用同一个任务跑一遍。别急着上 RAG,我昨天才第一次试,把账本变成可检索问答是后话,先把账算清。
📌 本文编译自 Hacker News,原文:https://news.ycombinator.com/item?id=49550324
版权归原作者所有,本文为基于公开报道的编译与独立分析。
物界前沿