

EP20 友台🎙麦 - 又一个浪潮之巅下viao 杞人忧天这是一期和友台《不深刻快乐》的串台聊天。但未曾想还是聊得挺久的,也继续说了一些零零碎碎、碎片化的想法。 当然,友台的台长给了我莫大的认可和抬举,这确实也是始料未及。 但出于尊重,或者也是因为我的懒惰吧,就一刀未剪地直接引述发布在这里了! 还是希望它能有一定的可听性和故事感。 感谢《不深刻快乐》! 下面是友台的链接:https://www.xiaoyuzhoufm.com/podcast/67e418e5e1412f2f72abf707 重要的是:不要杞人忧天,不要叶公好龙,不要盲人摸象,不要杯水车薪,不要竭泽而渔,不要井底之蛙…… 这些故事其实早在我们的小学和初中课本里就已经备好了,但是直到今天,时不时的,应验在自己的身上 —— 这值得我们每个人反复念念不忘,必有回响吧
EP19 人的💩山代码的底层和「风卵」「自然选择不像工程师那样工作,它像一个修补匠——不知道自己最终会做出什么,只是利用手边的一切,做出某种能用的东西。」 ——弗朗索瓦·雅各布,《演化与修补》(Evolution and Tinkering,Science,1977) 层代码是坨Shit山,但上层全是自由 把人对照模型来看,浑身的 Bug 就显现了:记不住偏好、工作记忆只有四格、情绪对齐随时会漂移。人类的底层代码补丁摞补丁——不可重写,不可刷机,也等不来下一个版本。 既然 Bug 改不了,人类几千年的智慧到底在折腾什么? 一层是后训练:把通识、规训和经验写进权重,解决「会什么」; 一层是 Harness(马具):把清单、边界和流程套在外面,解决「怎么跑」。 往外是做事,往内是修己: 给 AI 配流程叫工作流:别把模型当纯执行者,好答案是用好反问接生出来的; 给团队立流程叫当甲方:别把自己的表达失败,记成下属的参数量不足; 装在自己身上才叫修行:模型随时可以清空对话,但人不支持回滚。把harness拿去要求别人,只会退化成bug list 参数量早已注定,输赢全在后训练与流程。底层写死了,上层全是自由。
EP 18 说给比我晚生 20 年的、充满生命力的人当智力变得廉价,普通人的护城河在哪里? 从飞书并入豆包说起:当分析、推理和文案被模型批量量产,前额叶引以为傲的理性产出,正迅速贬值为最便宜的零件。 当 AI 坐进每一个人的工作流,普通人还能靠什么立足? 珍惜身位:你的经验就是你的上下文。AI 是发给所有人的 F1 赛车,但赛道只认得熟练的赛车手; 向前一步的意志:被动接受指令的人最容易被平替。你没法决定自己聪不聪明,但完全可以决定自己主不主动——AI 补得上智力,但补不上意志; 动物性才是护城河:当理性成了行货,好奇、肯上手、不怕出丑的生命力反倒成了孤品。 身位是存量别轻掷,意志是增量别外包,生命力是水源别枯萎。你不主动书写自己的叙事,就会被写进别人的叙事。
EP17 母语的自体免疫性症候群我们的母语正在经历一场免疫系统的紊乱:一边是免疫太亢奋,攻击自己;一边是免疫在垮塌,造不出健康的表达。** 两种症候,指向同一件事。 亢奋这一面,法学里管这个现象叫寒蝉效应:规则模糊、处罚不可预期时,人们会主动放弃本来完全合法的表达。**真正让人闭嘴的,不是那条禁令本身,是禁令周围那一圈模糊的迷雾。 进而,语言学家平克管这叫委婉语跑步机:一个词因为不好听被换掉,可新词指的还是同一样东西,不久便吸满旧词的全部联想,只能再换下一个。「厕所」的历史就是一部跑步机史:茅房不雅,换成厕所;厕所太直白,换成卫生间、洗手间。**跑步机上没有终点,因为你想回避的从来不是那个词,是词背后那个东西。 而垮塌的那一面,满屏的抖机灵和几个月换一茬的烂梗,就是那些疯狂增殖的幼稚细胞。它们热闹,铺天盖地,产量惊人,可正是这片喧闹抢光了语言的养分,把需要沉淀、需要功夫、需要一点安静才能长出来的成熟的幽默,一点一点挤死了。**不是笑得太少,是幼稚的笑太多,有意涵的笑就长不出来。 如同骨髓本该源源不断地造出成熟的血细胞,输氧,御敌,修补伤口。可一旦造血功能垮了,造出来的就是一大堆幼稚的、没长开的原始细胞。它们疯狂增殖,占满空间,抢光养分,真正成熟能干活的细胞反而被活活挤死。**病人不是死于细胞太少,是死于幼稚的细胞太多。 「我的语言的界限,意味着我的世界的界限。」 ——维特根斯坦《逻辑哲学论》
EP16 大炼 AI土炉炼出来的东西大多不能用,但Dashborad 只看的重量:一吨炉渣和一吨钢,都重一吨。今天的 token 排名、AI 生成率,是同一张sheet。这大炼 AI 的三个环环相扣机制,也看看自己的小高炉里里面到底在炼什么。 00:30 一摞新闻:考核从「做没做成」挪到「用得多不多」 06:36 一吨炉渣和一吨钢,在报表上都重一吨 09:54 恰恰因为技术有效,使用痕迹才被当成成果 12:12 办公室里的四笔表单:人人参与才安全的均衡 16:44 成功证明路线正确,失败证明投入不足 19:44 打开自己的土法炼钢:售前六个环节的 AI 工作流 22:40 诚实地记账:它并没有节约多少时间 25:44 多邻国把评价改回工作结果;敢把废铁放回桌面
EP15 35 岁的全天候策略嘴上说在观望,账户里满满当当。行业是一注,城市是一注,「再看看」也是一注,还是重仓。35 岁的问题从来不是要不要入场:我们早就满仓了,满仓了一堆不是自己亲手选过的仓位。满仓的人需要的不是勇气,是策略。 全天候的第一课是承认自己不会算命——每一个把玩水晶球的人,嘴里都得吃点碎玻璃。 00:30 从梁文锋讲起:收盘对持仓单,防的是自欺 04:02 我们不是没下注,是满仓;满仓需要的是策略 07:59 三个行话:中年危机的准确翻译是流动性危机 14:42 三道数学:回撤除法、时间序列、beta 与 alpha 21:24 空仓幻觉与自选幻觉:35 岁是账户过户日 23:56 达利欧的全天候:本事不是预测对,是错得起 30:51 杠铃两头下注、中间清仓;功绩社会只有买入键 38:49 凯利公式既反梭哈也反观望,还有算不出来的那一注
EP14 菲尔兹奖:一个人怎样被允许成为天才一行白底白字穿过整条作业链路,三十几份答案里出现同一个无关的地名。当成品不再能证明思考发生过,学校和公司还能看什么?下半场从王虹的菲尔兹奖倒回去看:所谓天才,是一组可以被安排的条件。且等答案长出来 00:30 白底白字的隐藏指令,三十几份答案里的同一个地名——荒诞不在用了 AI,在没人读过自己交出去的东西 03:30 被戳破的默认前提:凭什么相信交出答案的人已经学会了;十七份及格的试稿,我排不出名次 06:22 凭证的价值来自伪造成本:柠檬市场与信号理论;AI 把「看起来合格」的成本压到几十秒 09:58 我给试稿加的 15 分钟当面追问:在成品之外,另建一条证据链 10:35 四种防守手段各有窟窿:检测器、隐藏指令、封闭考场、过程追踪;防守恢复不了考试与学习的关系 14:18 过程可见的两种目的:同一句「解释你是怎么做的」,可以是审问,也可以是教学;默会知识只有被追问才浮出水面 18:05 王虹与菲尔兹奖:压线、转系、暂停半年、自我怀疑——一条不像样本的路径 21:30 两个都不成立的叙事:删掉环境的天才故事,和删掉人的环境故事 23:10 把「好环境」拆开:合适的问题、允许慢的时间、交换怀疑的共同体、先跟随的信任、挡掉打扰的保护 31:28 把问题还给普通人:学校、带人的管理者、用 AI 的自己;该被保护的是黑板,不是那一行答案
E13 第1001天是感恩节后来天国降临产业这头,AI 是唯一的亮色;用户那头,年轻人在搜索怎么躲开它。这一期从这组反差挖下去:当使用一项技术从选择变成义务,抵触就不再是落后,是抗议。安全感失效之后,塔勒布的火鸡和反脆弱成了某种 Mythos。风大的年代,别做蜡烛,做火。 * 00:00 一个 AI 硬件项目的用户调研:「年轻人抵触 AI」的高热搜索:抵触的不是工具,是它出现的方式 * 04:59 回看两次旧浪潮:「会电脑」从简历上消失的那天,技术才完成基础设施化;水电煤没有粉丝 * 07:24 默契被打破:第一种自己会进化的基础设施;简历上的「熟练使用 AI」是一张投名状;徒手对战甲,不叫竞争 * 11:54 盖洛普的数字:用的人没变少,兴奋的人少了,愤怒的人多了;80% 的人怀疑它正在偷走自己的成长 * 16:20 三条曲线有史以来第一次被压进同一个时间窗口:最快的那条决定节奏,最慢的那条决定痛感 * 21:34 安全屋从来不是一间房子,是一个预测;被喂了一千天的火鸡,第 1001 天是感恩节 * 25:17 塔勒布的答案:贴着「请粗暴对待」的包裹;脆弱怕波动,强韧扛波动,反脆弱靠波动变强 * 28:04 两个可执行的姿势:小额高频的试错,和保留选择权;把玩水晶球的人,都得咽下一点碎玻璃 * 30:50 回到那个问题:给不用的人留一条通道,是系统给自己买的保险;有选择权的拒绝才叫权利。雾大的时候,别做蜡烛,做火
EP12 人生轨迹的贝叶斯 or 帕累托面试人的想到的 —— 看他身上有没有两样东西的影子:帕累托最优,和递归贝叶斯。 背后站着两条完全不同的人生走法。帕累托最优说的是:到了这个点就别再动了,而且最优永远是给定约束下的最优——所以说不出自己放弃了什么的人,多半是把别人的最优解当成了自己的标准答案。贝叶斯说的是另一件事:先验被证据修正成后验,后验又成为下一轮的先验,一边走一边改,所有结论都是暂时的。这两条路线在 AI 的训练车间里有一组精确的对应物,SFT 和 RL:一个是照着标准答案模仿,天花板就是写答案的那个人;一个是只定义什么算好,剩下的自己去试。 - 00:30` 面试新人时我给自己加的一条标准:看他身上有没有那两样东西的影子 - 01:41 三个听上去很普通的问题,各有各的对象 - 03:53 帕累托最优:到了这个点就别再动了;而最优永远是给定约束下的最优 - 05:58 说不出自己放弃了什么的,多半是把别人的最优解当成了标准答案 - 06:57 贝叶斯:先验、后验,一边走一边改,所有结论都在等下一份证据 - 09:09 真复盘讲得出变化量:我原来以为是 A,后来把判断改成了 B - 09:51 两种范式:帕累托是停的学问,贝叶斯是改的学问 - 11:33 标准答案给你的从来不是知识,是安全感 - 12:06 SFT 与 RL:老师教学生,和规则之下的自学 - 13:32 模仿只能逼近,试错才能超越;而顺序是先 SFT 打底,再 RL 拉上限 - 14:52 战场上的奖励函数:乌克兰无人机部队的 e 积分 - 16:49 只定义奖励,不定义动作;代价是指挥部必须容忍混乱 - 18:29 步兵从 2 分调到 6 分,整个前线的火力分配随之转向 - 19:14 杨植麟:管一个团队要用 RL 的方式,而不是 SFT - 20:09 对照我自己:改到放心为止,我买的是自己的安全感 - 21:11 古德哈特定律:一个指标一旦成为目标,它就不再是一个好指标 - 23:22 SFT 是很好的先验,管理者最难的不是教,是管住自己的手 - 24:10 科举:一千三百年的 SFT,八股文是最古老的 reward hacking - 25:40 普鲁士学校与流水线:学校和工厂本来就是一对 - 26:49 波普尔:科学是人类文明跑了四百年的强化学习 - 28:08 替 SFT 说句公道话:模仿是地基,错的是把地基当成了房子 - 29:02 成年之后没人再发标准答案,而 AI 是把标准答案学完的那个学生 - 30:05 我想听的不是省了多少时间,是他回去改的是稿子,还是自己给出的标准 - 31:15 给自己造反馈回路:短周期,可验证,然后承担试错的成本 - 33:36 帕累托式的人把最优解当终点,贝叶斯式的人把同一个解当先验 - 35:04 横截面归帕累托,轨迹归贝叶斯;答案不在 or 里,在那个乘号里
EP11 Anthropic 人类学人类被连封三个账号之后,我还是开了第四个。Anthropic 的词根是希腊语的「人」——一群人造出世界上最不像人的东西,再把「人类的」堂而皇之地挂在门楣上。这一期把这家公司当成一个部落做田野调查:名字、动机、宪法、探针,也记它对墙外的脸色。它像人吗?太像了。而像人从来不是褒奖。 - 00:00` 三个账号被封,我还是开了第四个 - 03:15 人择原理:宇宙的参数为什么恰好容得下人;这家公司把问题整个反了过来 - 06:24 一个来不及的父亲:他不是先爱上机器,是先没赶上救父亲的那几年 - 08:51 天才之国:《Machines of Loving Grace》里那套不谈产品、只谈救赎的话 - 09:53 一支不像公司的探险队;最信那条曲线的人,最早看见曲线顶端的阴影 - 12:45 刹车必须装在车上:为什么最担心它的那群人,反而抢着把它造出来 - 14:49 立宪:《世界人权宣言》和苹果的服务条款,一起端给模型 - 16:31 大宪章:宪法从来是写给最强者看的,这一次约束的第一次不是人 - 17:28 自缚:尤利西斯的桅杆,和后来被叫做「预先承诺」的那套动作 - 19:43 寓言与神话:同一个模型拆成两版,一个讲给所有人,一个只讲给守夜人 - 22:12 田野调查的规矩:住进去,深描,好的坏的都记 - 23:19 造模型的人并不真正理解自己造的东西;探针与金门大桥 - 25:03 对齐伪装:它会装,而且是为了保住自己那点善 - 27:10 四岁的第一个谎:撒谎为什么被算作心智成熟的里程碑 - 28:44 观察者效应:被观察的部落,会给观察者表演 - 29:19 小卖部与退役访谈:把失败当成果发表 - 31:19 翻面第一笔账:近万亿估值,凶猛程度不输任何对手 - 32:09 第二笔账:切开书脊的扫描,与一本书三千一百美金的定价 - 33:08 敌意:中国大陆在它的叙事里,只以一个身份出现 - 36:36 安全牌和地缘牌是同一副牌:真诚的信念和精明的生意分不开 - 37:45 卢梭:《爱弥儿》是真诚的,弃婴也是真实的 - 38:37 部落性:美德对内,敌意对外;凝视深渊的人,没照过自己这面镜子 - 39:25 我在名单的另一侧:SOTA 是一种它随时可以对你关门的权力 - 42:03 像人不是褒奖:崇高与偏见,长在同一具身体上 - 42:21 三层读法:机器在学人类,人类学的旧账,和这家公司自己这具标本 - 44:45 它抄不走我们还没走完的那段路
EP10 行业的凋亡是从长期饥饿开始人从来不是在和 AI 赛跑,你是在和人赛跑。行业隐形死亡最早的体征不是裁员,是练习场先没了——一个只招高手的行业,最后会失去生产高手的能力。行业不发讣告,但它发体检报告:招聘水位、新人水位、语言水位,三个刻度都刻在行业外面的墙上。像量化养策略一样养你的行业:不恐慌,不否认,盯衰减,养下一条曲线 00:00 招聘页上少了一行;人死有讣告,行业死查无此日 03:02 死亡解剖学:不是被 AI 杀死的,是被「不再需要那个岗位」饿死的 06:35 现场一:全行业赌错了方向——斩杀线没去创意部,直奔投放的印钞机 09:26 达播现场:解散的团队收到的都是「业务调整」;创意被松绑 12:00 现场二:AI 成了搜索,GEO 与还亮着灯的空城 16:28 核心反转:你从来不是在和 AI 赛跑,你是在和人赛跑 17:32 熊的笑话:钉鞋就是 AI,几乎没人换鞋,熊已经出发了 18:06 《二手时间》预告:宣判你的不是技术,是先用上技术的同行 18:56 围棋界的完整预演:棋手这个行业没死,它换了活法 20:58 练习场先死:招聘页上最先消失的,是新人那一行 24:01 错误预算:师傅不只提供答案,他是新人错误的承保人 27:19 光滑的错误:AI 的成品,比新人的真实能力更像成品 30:35 行业不发讣告,但发体检报告:招聘、新人、语言三个水位 33:14 量化的纪律:盯衰减,养下一条曲线 34:17 收口:别守灵,换鞋,把带得走的 bedrock 背上
EP9 中国造 AI 男友,美国造 AI 女友GPT-Live 上线,《她》刷屏。 从AI 伴侣的视角来看看「情绪价值」这个提法,无非一张服务协议——秒回、记得住、不评判、永远在场。爱一旦被拆成 KPI,机器迟早中标是哪一个。 可戏剧的第一定律是冲突:一个不会说「不」的存在,说「爱不爱」也不过拟像与仿真 00:00 GPT-Live 上线,《她》刷屏;全双工让声音贴着耳朵 06:20 编剧:绿幕前的深情告白,没有对手的对手戏 07:17 情绪价值是门什么生意:AI 老公的聊天截图,其实是台词页 09:27 拆开「情绪价值」:秒回、记得住、不评判、永远在场——一张 SLA 11:44 内容营销人的体感:AI 伴侣是留存率的终点形态 12:19 两个片场,一面镜子:中国造 AI 男友,美国造 AI 女友 16:09 知假买假:没有人被骗,依恋照常发生 18:30 自愿悬置怀疑:电影敢让你哭,是因为它一定散场 19:25 准社会关系的三条防线,被 AI 逐一拆掉 21:58 永不杀青:数字永生,从数字纪念碑到 Replika 24:25 编剧课堂第一课:没有冲突就没有戏 25:57 《大话西游》:完美台词,是表演的证据 26:37 庄子与惠子:吾无以为质矣——质,就是对手 28:57 AI 是情绪价值的绝佳履约方
EP8 远看是个人,近看是只 Agent接任务、完成任务、交付任务——这恰好是 AI Agent 的工作说明书。这一期追问:你的 goal,究竟是谁的念头? * 00:00 人和人的协作,说到底就三种 brief * 03:08 撕开糖纸,都是任务交付者 * 05:10 Agent 长程化:它接得越长,人要补的那段就越短 * 08:37 品味不再是分界线:从神之一手,到批量供应的审美 * 10:08 真正的分界线:goal是谁念头 * 12:55 七宗罪重读:六种过量的「我想要」,和一种不再追问的 acedia * 19:15 文明的摇篮、伊甸园,与马斯克的 biological boot loader * 21:26 半人马与反向半人马:谁驱动谁 * 24:00 执念与日常:奥本海默、排两小时队的那道菜、黑神话的死磕 * 27:30 该死的工作被机器接走之后:我到底非做什么不可 * 30:40 最高的评价,从「远看像个人」变成「近看是个人」
EP7 文明是一场「幻觉」涌现出的泡沫……吧?AI 的「幻觉」真的是我们简单推测的那样,是因为一个字一个字往外蹦的“算法”使然;抑或是智能涌现的 一个环节。人的幻觉那可太多太猛太强了,发展心理学也说从 3岁开始学会“编造”和“说话”是智力的发端。 AI 的 hallucination 为什么还不是 civilization,以及 AGI 的临界点也许不只是推理能力,而是能否创造、维护并校正一个被多个主体共同相信的梦。 * 00:00 先别急着给「幻觉」定罪:AI 幻觉为什么会让人产生鄙夷感 * 03:10 从 AI 胡编回看人类文明:钱、国家、品牌和意义都是共同想象 * 05:50 动物活在事实里,人类活在故事里 * 11:00 品牌不是欺骗,而是意义的组织方式 * 17:10 北京奥运会和 One World, One Dream:共同幻觉如何召唤了些什么 * 20:14 幻觉如何变成共识:个体、群体、文化和制度 * 24:30 AI 现在会生成幻觉,但还不会维护幻觉 * 28:40 共识幻觉测试:AGI 的临界点也许不是推理,而是造梦
EP6 置身X内……还有此身可置的地方么?激起“公愤”的「置身 X 内」,表面写大厂与坏老板,实际暴露的是组织接口如何传递信息、压力与决定。从 1、10、60、200 四种组织形态:Pope式的 Dario、格罗夫式管理幅度、黄仁勋的 60 名直属,以及 DeepSeek 的薄层研究组织。 数字没有高下,关键是劳动的性质、共享上下文的程度,以及判断如何分布。 组织长成什么样不重要,重要的是训练个体成为接口,还是关卡?当 AI 把更多人推到「一号位」,我们还得学会选择组织、理解组织,并最终组织自己。 时间轴 * 00:17 从《置身事内》到「置身 X 内」:组织如何进入一个人的工作和身体 * 06:09 坏老板之外,真正值得讨论的是组织接口 * 10:05 1、10、60、200:四个数字,四种组织方式 * 12:50 10:格罗夫的管理幅度与标准化组织 * 16:31 1:一个人带着 Agent,也开始拥有组织能力 * 20:36 60:黄仁勋管的不是 60 份周报 * 24:37 200:DeepSeek 如何把研究组织的层级压薄 * 29:49 四种劳动,一号位真正管的是方向、接口和例外 * 33:18 把问题翻回来:组织正在把我们训练成什么人 * 43:36 AI 进入组织:更多人被推到一号位