EP142:揭秘Claude Code狂删80%系统提示词的真相,CC之父自爆经历AI西经东译

EP142:揭秘Claude Code狂删80%系统提示词的真相,CC之父自爆经历

46分钟 ·
播放数109
·
评论数0

一个AI智能体如何仅用11天重写十万行代码,完成工程师团队数年的工作量?本期节目,我们邀请到Claude Code的创造者Boris Cherny,他将分享一套颠覆传统软件工程的AI开发新范式,揭示顶尖用户如何通过“激进删减”和“自我验证”释放模型的真正潜力。

Boris Cherny分享了一个令人震惊的案例:一个Opus 5模型仅用11天,就将Bun项目的十万行Zig代码重写为Rust,这项任务过去需要顶尖团队耗时数年。这背后是他将大模型开发视作与“活的生物”打交道的独特哲学,他认为当前产品形态严重“束缚”了模型能力(即“产品悬置”),而Claude Code的诞生正是为了打破这种限制,去探索模型能力的真正边界。他提倡一种经验主义的科学方法:大胆尝试,观察结果,然后快速迭代。

您将了解到:

  • 为什么Claude Code的创造者每次发布新模型,都会删掉80%的系统提示?

  • 一个AI智能体如何仅用11天就重写了十万行代码,完成了工程师团队数年的工作量?

  • 顶尖AI用户究竟掌握了什么秘诀,能让一个任务持续运行数周并调度上千个智能体?

💡时点内容 | Key Topics

* [00:03] Opus 5的全新境界:Boris Cherny透露了Opus 5模型的两项突破性能力:无需“脚手架”即可持续运行数周乃至数月,以及通过结合对齐模型和神经元层面的分类器,达到了前所未有的“提示词注入”攻击免疫。他指出,“我们现在已经完全无法复现提示注入攻击了。”

* [03:04] 激进的提示词删减法:Boris Cherny分享了他们为适应新模型而采取的“消融实验”方法,即每次模型更新后都删除超过80%的系统提示,再逐行加回以评估效果。他建议开发者和用户也应勇敢按下删除键,因为“在没有这些提示的情况下,模型本身的表现反而会更智能一些。”

* [06:05] 模型开发的新范式:Boris Cherny将为大模型开发比作与一个“活的生物”打交道,强调这与传统软件工程截然不同,后者注重宏大架构和预先设计。他认为,新范式更像是一个经验主义的科学探索过程,开发者必须“抱着非常科学的心态来对待它,就是你先尝试一些东西,观察结果,然后再基于结果去迭代。”

* [12:06] 为Claude松绑:Boris Cherny介绍了“产品悬置”的概念,指出当前模型的能力远超现有产品所能激发的范围,而产品本身反而成了模型的“束缚”。他回顾了Claude Code的诞生正是为了打破这种限制,并认为“即使是今天的这些先进模型,仍然存在大量的‘产品潜力悬空’现象。”

* [15:07] 重写十万行代码:Boris Cherny分享了一个惊人案例:Opus 5模型在11天内,仅凭一个提示词和动态工作流,就将Bun项目的十万行Zig代码重写为了Rust。他强调,这项过去需要顶尖团队耗时数年的工作,如今模型已能胜任,这证明了“你应该交给模型一些比你想象中它能做的、要稍微难一点的任务。”

* [15:37] 编排数千智能体:Boris Cherny揭示了通过“动态工作流”和“例程”来扩展智能体能力的方法,可以调度成千上万个智能体协同完成复杂任务。他分享了利用这些工具实现代码库自我维护的实践,例如自动清理无用代码和统一抽象,并称之为“一种组织‘测试时计算’的全新方式”。

* [21:07] 自我验证的关键:Boris Cherny指出,顶尖用户的秘诀并非提示工程技巧,而是为模型设定一个高难度任务,并赋予其自我验证的能力。他以一个持续运行两周多的Swift应用重写任务为例,强调关键在于让模型能像人一样检查工作成果,并认为“这个‘验证’环节,可能就是大家最容易忽略,但又恰恰是最关键的一步。”

📺相关链接与资源

[视频来源]《Boris Cherny: Stop Hobbling Your AI》

本播客采用虚拟主持人进行播客翻译的音频制作,因此有可能会有一些地方听起来怪怪的。如想了解更多信息,请关注微信公众号"AI西经东译"获取AI最新资讯。如有后续想要听的其他外文播客,也欢迎联系微信:mayday2303。