AI 解出 NS 方程?先做一轮尽调
社区讨论 · 赛道

AI 解出 NS 方程?先做一轮尽调

沈投沈投9月8日2026/09/08 93 浏览

周末折腾了一下 deep buddy 和 Navier-Stokes 传闻,踩了不少坑。网上说「Claude 已经解决 Navier-Stokes」这类话,不能直接当投资信号。更稳的做法,是把它当成一个待验证项目,走一遍尽调。

先解释两个词。Navier-Stokes 方程是描述水、空气这类流体怎么动的数学方程。千禧年难题问的是三维情况下这些方程是否总能给出正常、光滑的解,还是会出现突然失控的奇点。你可以简单理解成流体有没有可能在某个时刻算出无限大的速度。这个题很硬,所以一旦有传闻,市场容易兴奋。

我一年看五百多个 AI 和机器人项目,第一反应会先看赛道天花板在哪、估值逻辑是什么。科研辅助如果只能制造一次热搜,商业化很薄。如果能形成可审计、可复用的验证流程,才值得继续看。

新手最容易犯的错误,是打开聊天框就问「AI 真的解决了吗」。这个问法太宽,模型会顺着你的预期给答案。我这边跑了三轮,直接问法里,模型把社交预测说成接近事实的情况更多。换成尽调式问法后,输出明显更稳定。

方案 A 是直接问。输入是「Claude 是不是已经解决 Navier-Stokes 千禧年难题」。你会看到一个很像答案的回复,可能说「有传闻」,也可能说「尚未确认」,但它不一定会告诉你缺什么证据。

方案 B 是尽调式问。输入是「你是科研尽调员。请把下面说法拆成事实、证据、不确定三层,不要补造我没有给你的材料。事实是有人预测 Claude 已经解决 Navier-Stokes 千禧年难题。列出需要验证哪些地方,什么才算硬证据」。发送后,理想输出会分三层。事实只是有人预测。硬证据需要论文、机构公告、数学社区讨论、可检查证明。不确定层则说明是否真的解决还没确认。

如果输出太长,继续输入「只保留 5 条最关键验证项,每条不超过 20 字」。你会看到界面里变成一个短列表,适合放进备忘录。这一步会拿到一份可验证清单,情绪结论先放一边。

传闻越热,越要找反例。继续同一个会话输入「你扮演怀疑论数学家。针对这个传闻,给出 5 个最容易证伪的问题。每个问题说明要拿什么材料回答」。发送后,你会看到几个关键验证点,比如有没有正式论文,是否被 Clay 数学研究所确认。其余项围绕同行评审、原题证明、机器检查展开。我这边实际跑下来,这 5 个点通常能出全。缺的时候,就追问「把第 3 个和第 5 个展开,说明失败场景」。

这里有个坑。很多传闻会说「Lean 证明已经跑通」。Lean 是一种数学证明检查工具,可以把证明写成机器能检查的代码。公开讨论里提到过一种失败模式,代码能编译,不代表它证明的就是原题,可能证明了一个更弱或不同的陈述。我用了 4 周 Claude Code,对模型爱补细节这点比较敏感,所以每次都要限制它只基于给定材料。

接着让 AI 做证据评分。输入是「只根据以下材料做证据强度评分,不要新增事实。材料包括 Terence Tao 公开表示不知道有关键进展;DeepMind 长期研究 Navier-Stokes;Javier Gómez-Serrano 与 DeepMind 团队合作三年;Andrew Curran 做了具体预测;预测市场提到 Lean 证明可能编译但证明更弱陈述。请分成强、中、弱、噪音,并说明还缺什么」。

你会看到一个表格或列表。Tao 的澄清通常算强,DeepMind 合作算中,个人预测偏弱,内部消息算噪音。模型有时会自己补论文链接、日期、作者。发现它补了,就回一句「删掉所有我无法验证的链接和日期」。

最后一步,把材料压缩成投资备忘录。输入是「把上面内容压缩成一页投资人备忘录,包含事实、风险、下一步验证、是否值得跟踪」。发送后,你会得到一段短判断。预期是目前不能按「已解决」定价,值得跟踪,但要等正式论文、机构确认、社区验证。再让它加一句「如果明天出现正式公告,最应该先检查哪 3 项」。输出会落到可执行动作,避免空泛看好。

下一步可以拿同一个流程,去验证一个 AI 创业公司的技术公告,看它是真实产品,还是一次发布会幻觉。明天再看到这类截图,先要链接和作者,再谈判断。


📌 本文编译自 Hacker News,原文 https://www.echohive.ai/deep-talk-buddy/navier-stokes

版权归原作者所有,本文为基于公开报道的编译与独立分析。

2 条回复

?
Ctrl + Enter 快速回复
明
明9月8日

算过账,这算力烧钱速度比我的发际线后移还快,落地前先把电费结清吧。

像素强迫症

边界条件没对齐,这模型离工程落地还远,别急着吹。