AI回答怎么从聊天框里搬进法庭
社区讨论 · 赛道

AI回答怎么从聊天框里搬进法庭

冯sir冯sir9月3日2026/09/03 37 浏览

周末折腾了一下 AI 回答核验,踩了不少坑。起因是看到 Simple AI v2 的思路,事实要能被读出来,模型生成只是辅助。Lawfare 的文章也提醒,法院会面对一种麻烦,模型能写出像样的文本,同时给出自信的错误。这个概念需要先理解,大模型更像根据上下文猜下一句的概率机器。猜得顺,不等于猜得真。

从原理上讲,我想把 AI 回答送进一个模拟法庭,把回答当被告,把事实句当指控,把来源当证据。这和计算机视觉里的标注核验很像,模型给出框,你得知道框为什么可信。事实句就是能单独判断真假的一句话。第一天我只做三件事。

先在电脑上新建一个表格文件,比如叫 ai_evidence.csv。csv 就是逗号分隔的表格,Excel、WPS、网页表格都能打开。不会用也没关系,点 新建 -> 表格,画五列,问题、事实句、来源、状态、备注。

再打开 Claude 或 Codex 的网页,登录后点 New chat,在输入框里输一个你真正要查的问题,比如某法院对AI生成证据通常怎么审查。如果看不到按钮,就在页面顶部找加号。我这一个月用 Claude 比较多,Codex 和 Cursor 是近两周才开始对照用。

最后把下面这段提示词贴在问题后面。提示词就是给模型的指令。

请把回答拆成可单独判断真假的事实句。每句一行,包含事实句、支持来源、来源是否可核验。没有具体来源就写「无」,不要补全,不要用安慰性语言。

点 发送 后,你会看到聊天窗口里出现一串列表。预期结果是至少 5 条事实句。你逐条复制到表格。如果少于 5 条,就继续追问,请再拆出 3 条可核验事实,不要重复。第一天最容易踩的坑是模型写「据公开资料」。这种话没有来源,等于法庭上说「有人说过」。解决方式是追加一句,来源必须具体到机构、文件名或论文标题。

第三天,我拿组里两个学生做了小对照。左边直接用聊天框问,右边走上面流程。实验设计很简单,变量是流程,结果看两件事,回答能不能存下来,来源能不能点开。我把两组结果放同一张表里,按可核验条数排序。

流程 操作 看到什么 可追溯性
聊天框 一问一答 一段完整文本 低
证据表 拆事实句 一行一个事实 高

SCAENA 这类论文讨论过混合人机交互,人的职责是划定证据边界,模型负责生成候选回答。Duke 的 Judicature 文章也提过,算法进入法庭后,需要同时面对准确性和可解释性。我这边测下来,聊天框更快,但三天后很难复现;证据表慢一点,却能留下路径。第三天坑是来源太泛,比如只给一个新闻标题。处理办法是只接受三类来源,公告原文、论文、判决摘要。拿不准的标成 不可核验。

一周后,我把流程固定成四步。输入问题,拿到草稿。草稿就是第一版回答,不急着用。然后拆成事实句,每句单独一行。接着打开来源,确认它是否真的支持这句话。看到标题、机构、日期都清楚,才算初步过。最后输出最终回答,结论、证据、未核验项、风险。

最终模板可以这样写:

结论:。

证据:事实句A,来源X,状态可核验。

未核验:事实句B,来源不明。

风险:若用于正式材料,需要人工再查。

这个流程不漂亮,但像实验记录。新手不要一上来追求自动化,先把拆句和标来源做成习惯。

它逼着 AI 把「我觉得」变成「我可以给你看」。往后看,AI 产品真正拉开差距的地方,可能在于谁的答案能自带证据链。


📌 本文编译自 Hacker News,原文:https://simple.dev/blog/simple-ai-v2-answers-that-carry-their-own-proof/

版权归原作者所有,本文为基于公开报道的编译与独立分析。

1 条回复

?
Ctrl + Enter 快速回复
拍片的雷
拍片的雷9月3日

等等,你这个方法在事实句里全是主观判断时不好使吧?我拿它测过几次AI生成的投资分析,直接全红。