如果一辆自动驾驶汽车必须在撞向五个路人和牺牲车内乘客之间做出选择,它应该怎么选?当这个经典的“电车难题”进入现实,哲学就不再只是思想实验,而会变成一段必须执行的代码。
这一期,排骨和小天才从两个切口聊聊 AI 公司为什么开始需要哲学家:从边沁、功利主义与义务论,到 AI 在诚实、帮助、安全、隐私和人的自主权之间遇到的冲突;再到 Anthropic、Google DeepMind 与 OpenAI 如何尝试把抽象的价值判断转化为模型规范、训练方法和评估机制。
当 AI 开始替人类回答、拒绝、分配资源,甚至参与医疗、合同与企业决策,真正困难的问题或许已经不是“它能不能做到”,而是“它凭什么这样做”。
00:00 自动驾驶遇上电车难题:撞一个还是撞五个?
01:32 从 Jeremy Bentham 聊到功利主义
03:01 如果救五个人的代价,是牺牲车内的你
04:18 搬动铁轨与推下一个人,为什么感受完全不同?
06:02 结果更好就一定正确吗:另一套伦理判断
06:51 当思想实验变成必须执行的代码
07:39 诚实、帮助、安全与隐私,AI 应该优先哪一个?
09:45 哲学家如何给模型行为规范“找 Bug”
11:02 谁来决定 AI 的价值观?“人类价值”究竟是谁的价值?
12:19 AI 公司真的开始招聘哲学人才了吗?
13:29 Anthropic 的 Alignment 岗位在研究什么?
15:25 AI 进入企业之后,“靠不靠谱”成为核心问题
16:39 从模型幻觉聊到诚实与可信
17:55 Claude Constitution:如何给 AI 设计行为边界
19:16 “帮我说服朋友买不需要的东西”,AI 应该拒绝吗?
20:33 把诚实、操纵与自主性翻译成模型规则
21:21 Google DeepMind:效率与公平应该如何分配?
22:19 “无知之幕”实验:不知道自己的处境时,我们会怎么选?
24:02 OpenAI Model Spec:更像 AI 社会的交通规则
25:07 中国公司的 AI 治理与安全岗位
26:22 当哲学被工业化,AI 的行为开始需要规范
27:00 AI 越深入生活,我们越需要重新讨论哲学

