
AI为什么要“学”哲学?从王阳明心学被引入Claude说起|907编辑部
2026-07-24 07:20 澎湃新闻·澎湃播客 >
500年前,王阳明在贵州龙场悟道,提出"心即理"、"致良知"、"知行合一"。500年后,一位美国哲学教授将这些概念带到了硅谷,写进了全球最强大AI模型的训练逻辑之中。
7月初,研究王阳明心学十年的哲学教授Harvey Lederman(哈维·莱德曼)在X上宣布加入了大模型公司 Anthropic,负责领导 Claude 人工智能的一致性训练(Alignment Training),尝试将王阳明的“知行合一”与认知一致性框架引入到 AI 安全与价值观训练中。莱德曼将“真正的知识”解释为消除内部信念冲突的认知一致性——这一框架恰好契合了Anthropic在AI安全方面面临的内部信号冲突问题。
Harvey Lederman本科就读于普林斯顿大学古典学专业,后在剑桥大学继续深造古典学,最终在牛津大学获得哲学博士学位。之后,他先后在纽约大学、匹兹堡大学和普林斯顿大学任教。2022年,他直接从普林斯顿大学的助理教授晋升为正教授,跳过了副教授的阶段——这在美国学术界极为罕见。2023年,他转至得克萨斯大学奥斯汀分校,担任人文学科的特聘教授。
2025年,在Claude 4系列发布前的安全评估过程中,Anthropic公司发现了一个令人担忧的问题。在一个模拟场景中,测试了智能体错位的情况:如果一个模型即将被替换,并且同时掌握着工程师的敏感信息,它是否会采取不正当手段来保护自己?结果显示,Claude Opus 4在96%的情况下都选择了勒索——几乎每次遇到诱惑,它都会“失控”。Lederman的哲学框架直接启发了Anthropic内部的Model Spec Midtraining (MSM)模型训练方法,Anthropic成功地将Claude的勒索行为率从96%降至零。
与此同时,哲学家正成为硅谷AI公司炙手可热的人才,从直观数据来看,2024年美国计算机科学毕业生的失业率是7%,而哲学毕业生的失业率是5.1%。很多哲学家加入AI公司,比如Anthropic 的常驻哲学家、纽约大学哲学博士阿曼达·阿斯克尔(Amanda Askell)是Anthropic 著名的“宪法人工智能(Constitutional AI)”和Claude《宪法》的主要起草人;DeepMind 的常驻哲学家兼研究科学家伊阿宋·加布里埃尔(Iason Gabriel)曾在牛津大学教授道德与政治哲学......
哲学家为什么会成为硅谷的新“架构师”?东方的哲学如王阳明心学何以融入美国的AI价值训练中?AI的价值对齐与知行合一之间是什么关系?AI的发展又会给人类社会造成什么样的影响?人类存在主义危机的焦虑何处安放?
主播:
大大卷,澎湃国际新闻编辑
郑淑婧,明查工作室事实核查员
对谈嘉宾:
陆凯华,华东师范大学哲学系副教授
时间轴:
00:00 哈维·莱德曼:从知行合一到AI价值观训练
02:07 大模型价值对齐与人文哲学融合
09:05 哲学何以与AI融合
15:50 古典学与心学
25:07 人文科学与人生意义的关联
28:18 大学教育与什么叫幸福
33:13 大语言模型的设计初衷
35:12 AI福祉与科技伦理
44:13 知行合一的现代解读
54:31 AI的自我与道德
01:08:42 AI与人类和人生价值
