037.别再卷模型,该规模化的是判断力

037.别再卷模型,该规模化的是判断力

24分钟 ·
播放数62
·
评论数0

本期要点

· 判断力才是瓶颈:换更聪明的模型只得到稍好的答案,但拿掉测试/门禁/审查,整套系统立刻垮掉。模型是原始天赋,判断力是组织。

· 三个可执行原语:技能(把资深工程师会问的问题写成可执行的判断力,技能不是文档)、工作日志(跨会话的记录,让新智能体一句"继续"接上)、人格角色(决定用谁的眼睛看,按需加载一种你不具备的判断力)。

· 验证是一架梯子:构建测试→截图推理→运行视频→生产遥测。能无人参与跑通几级,就能交出去多少;自主性是一级一级挣来的。

· 门禁必须下沉到咽喉位置:仓库钩子拦不住补丁工具,要下沉到操作系统层;永远不要给智能体一个它可以自己批准的理由——带后门的门禁就不是门禁。

· 编码判断力会腐烂:为上个架构写的技能不是"过时"而是"错了",而错了比没有更糟,因为智能体会相信它。靠失败复盘回写 + 定时巡检让判断力保持最新。

· 案例账本:特性开关清理智能体七发七中,每个 PR 1.26 美元,年成本不到 700 美元,对比人工约 26000 美元。