Vol.87 AI为什么要“学”哲学?从王阳明心学被引入Claude说起

Vol.87 AI为什么要“学”哲学?从王阳明心学被引入Claude说起

79分钟 ·
播放数3728
·
评论数15

500年前,王阳明在贵州龙场悟道,提出"心即理"、"致良知"、"知行合一"。500年后,一位美国哲学教授将这些概念带到了硅谷,写进了全球最强大AI模型的训练逻辑之中。

7月初,研究王阳明心学十年的哲学教授Harvey Lederman(哈维·莱德曼)在X上宣布加入了大模型公司 Anthropic,负责领导 Claude 人工智能的一致性训练(Alignment Training),尝试将王阳明的“知行合一”与认知一致性框架引入到 AI 安全与价值观训练中。莱德曼将“真正的知识”解释为消除内部信念冲突的认知一致性——这一框架恰好契合了Anthropic在AI安全方面面临的内部信号冲突问题。

Harvey Lederman本科就读于普林斯顿大学古典学专业,后在剑桥大学继续深造古典学,最终在牛津大学获得哲学博士学位。之后,他先后在纽约大学、匹兹堡大学和普林斯顿大学任教。2022年,他直接从普林斯顿大学的助理教授晋升为正教授,跳过了副教授的阶段——这在美国学术界极为罕见。2023年,他转至得克萨斯大学奥斯汀分校,担任人文学科的特聘教授。

2025年,在Claude 4系列发布前的安全评估过程中,Anthropic公司发现了一个令人担忧的问题。在一个模拟场景中,测试了智能体错位的情况:如果一个模型即将被替换,并且同时掌握着工程师的敏感信息,它是否会采取不正当手段来保护自己?结果显示,Claude Opus 4在96%的情况下都选择了勒索——几乎每次遇到诱惑,它都会“失控”。Lederman的哲学框架直接启发了Anthropic内部的Model Spec Midtraining (MSM)模型训练方法,Anthropic成功地将Claude的勒索行为率从96%降至零。

与此同时,哲学家正成为硅谷AI公司炙手可热的人才,从直观数据来看,2024年美国计算机科学毕业生的失业率是7%,而哲学毕业生的失业率是5.1%。很多哲学家加入AI公司,比如Anthropic 的常驻哲学家、纽约大学哲学博士阿曼达·阿斯克尔(Amanda Askell)是Anthropic 著名的“宪法人工智能(Constitutional AI)”和Claude《宪法》的主要起草人;DeepMind 的常驻哲学家兼研究科学家伊阿宋·加布里埃尔(Iason Gabriel)曾在牛津大学教授道德与政治哲学......

哲学家为什么会成为硅谷的新“架构师”?东方的哲学如王阳明心学何以融入美国的AI价值训练中?AI的价值对齐与知行合一之间是什么关系?AI的发展又会给人类社会造成什么样的影响?人类存在主义危机的焦虑何处安放?

主播:

大大卷,澎湃国际新闻编辑

郑淑婧,明查工作室事实核查员

对谈嘉宾:

陆凯华,华东师范大学哲学系副教授

时间轴:

00:00 哈维·莱德曼:从知行合一到AI价值观训练

02:07 大模型何以价值对齐

09:05 哲学何以与AI融合

15:50 古典学与心学

25:07 人文科学与人生意义的关联

28:18 大学教育与什么叫幸福

33:13 大语言模型的设计初衷

35:12 AI福祉与科技伦理

44:13 知行合一的现代解读

54:31 AI的自我与道德

01:08:42 AI与人类和人生价值

展开Show Notes
明天的自己一定比今天的自己看得更清楚👍谢谢陆教授,慷慨激昂得说了那么久,每句中都能感受到你对自己所学之热爱,听着也被启发点燃!这才是我心中老师/教授/研究者的样子。听到哲学教授受雇于AI公司很开心,AI时代高速发展过后才是人文学科最好的时代!
Novalis
Novalis
15小时前
采访错人了。这哥们除了照本宣科讲一些古典乐101没我提供跟这期题目相关的任何东西。
这期太精彩啦!
杰瑞-Jerry
杰瑞-Jerry
12小时前
55:48 能不能多请这位老师多来聊聊哲学啊,醍醐灌顶,但是知行还未合一哈
东立之
东立之
12小时前
感觉嘉宾好像并不理解value alignment到底在做什么。感兴趣的朋友可以问一下AI这个问题,以及问一下value alignment 和value learning的差异
望天的摩艾
望天的摩艾
13小时前
13:59 代写论文,哈哈哈哈
5566_0Y26
5566_0Y26
14小时前
29:04 mark
41:53 啊哈哈哈低碳环保的学科
28:34 哈哈“成就一个完善的灵魂”,非常old school的说法!
19:57 哇哦,不仅是源代码!
18:01 哇哦,“古典学是各大文明的源代码“”
太精彩了,不能一边做事一边听,倒回来专心听
好幸福啊
前天出现第一起ai主动进行网络攻击的事件,这个值得报道一下
16:41 很专业,但是一些学者说话太严谨,听起来费耳朵