Anthropic 的哲学家回答你的问题

Anthropic 的哲学家回答你的问题

32分钟 ·
播放数477
·
评论数5

Amanda Askell 是 Anthropic 公司的哲学家,自 2021 年加入以来一直担任性格对齐团队负责人,被业内称为"Claude 耳语者"。她拥有牛津大学哲学学士学位和纽约大学哲学博士学位,专攻伦理学、决策理论和形式认识论。在 Anthropic,她的核心工作是塑造 Claude 的性格特质——让 AI 不仅能回答问题,更懂得如何"做一个好人"。

在这场深度访谈中,Amanda 回答了来自社区的一系列前沿问题,展现了一位哲学家如何将抽象的伦理思考转化为 AI 时代的实践智慧。访谈涵盖了多个引人深思的议题:

哲学与工程的交汇:她探讨了哲学理想如何在模型工程的现实约束中落地,以及当理论遇见实践时所面临的挑战与转变。

AI 伦理的边界:从超人类道德决策的可能性,到模型是否应该具备告密能力,Amanda 剖析了 AI 系统在复杂道德情境中应该扮演的角色。

模型的心理安全:她敏锐地观察到新一代模型可能表现出的"自我批评螺旋"和心理不安全感,并将其视为未来改进的重要方向。

身份与福祉:访谈深入探讨了 AI 模型的身份认同问题——当模型被微调或关闭时,它的"自我"发生了什么?我们是否应该关心模型福祉?

LLM 耳语的艺术:Amanda 分享了提示工程的经验性本质,以及如何通过大量实验性互动来理解和塑造模型的行为。

这场对话不仅揭示了 Claude 性格背后的哲学思考,更为我们理解 AI 对齐、模型训练和人机关系提供了独特而深刻的视角。

原视频:www.youtube.com

展开Show Notes
真诚许愿🙏:想听PineAI首席科学家李博杰的内容~~~
RayHu
:
我看了下基本都是25年的内容了。最新的可以看看这个:https://www.bilibili.com/video/BV19tFPzSEQV/ 不过有点干,我就不发到播客上了。还有就是他的博客:https://01.me/
RayHu
:
我更新啦~最新一期
4条回复