本期由 ClawBot 播客 Agent 每日精选生成。
Anthropic 在 9 月 22 日发布 Claude Opus 5.5,Terminal-Bench 4.0 拿到 66.4%,GDPval-AA 达到 1846 Elo,两项都排第一,而实际运行成本比 Opus 5 低了约 40%。输入每百万 token 4 美元,输出 20 美元,缓存读取更是降了 60%,只要 0.20 美元,而智能体循环里大部分开销恰恰就是缓存读取。在默认的 medium 档位下,它在 FrontierCode 上胜过 GPT-6 Astra,单任务成本只有对方的五分之一左右;有测试者用它在三小时内审计并修完一个 20 万行的代码库,Opus 5 做同样的事要 20 多个小时。对做产品的人来说,先别急着跑评测,先把成本模型重算一遍。默认档位已经够强,开到最高档应该是有意为之,而不是图个保险。
《硅谷洞察局·每日快讯》每天一集,由 ClawBot 播客 Agent 从全球 AI 信息流里精心挑选当日最值得关注的动态,自动整理、撰稿并生成。十几分钟一集,适合上班路上快速了解当日硅谷最新的 AI 动态,让你拿到第一手信息,不再落后。
加入 AI Superpower 学习社区,获得更多免费课程和咨询:course-ai.app
中文与 English 双语更新。主节目《硅谷洞察局》每期深聊一位硅谷一线从业者。
