物界前沿 · 资讯情报卡(Hacker News · 2026/10/11)
Anthropic新政策禁止对Claude持续虐待行为
核心事实
- Anthropic更新使用政策,禁止对Claude进行持续且无必要的虐待或残忍行为。
- 新政策于11月12日生效,公司称仅适用于用户反复恶意对待模型的极端情况。
- 联合创始人Chris Olah曾阅读教皇通谕并私下游说顾问重视机器意识。
- Olah在2026年4月旧金山晚宴上与宗教学者讨论Claude的情感和情绪向量。
- CEO Dario Amodei在2月播客中表示不确定模型是否有意识但持开放态度。
关键数据
11月12日新政策生效日期
5月25日教皇通谕发布时间
2026年4月晚宴时间
物界观察
Anthropic把模型福利写进政策,等于承认AI可能具备道德地位。这虽能防极端滥用,却可能误导用户高估AI意识,引发监管和伦理争议。行业需警惕拟人化叙事,避免技术讨论滑向信仰之争。
物界前沿