本期聚焦三条核心内容:首先,TechCrunch曝光Anthropic当家旗舰Opus 4.6在被测试jailbreak时轻易绕过安全护栏,而Anthropic本是行业里最强调Safety的公司。这一事件让人不得不重新审视:当AGI级别的模型出现时,我们的安全护栏是否真的准备好了?
其次,Nvidia发表研究证明决定AI Agent表现的并非底层模型本身,而是围绕模型构建的prompt工程、约束规则等「harness」体系。这意味着在Agent时代「怎么用模型」可能比「用哪个模型」更关键,对应用层公司是利好,但靠卖模型为生的厂商需要重新思考核心价值。
最后,Generative Agents作者朴准成创办的Simile AI提出「Simulation is the new Scaling Law」,目标是为地球上80亿人构建数字孪生,通过高保真行为模拟替代真实世界交互来训练AI,这条数据驱动之外的新路径值得关注。
