[人人能懂AI前沿] 揭秘AI的执行力、工作流与反思力

[人人能懂AI前沿] 揭秘AI的执行力、工作流与反思力

32分钟 ·
播放数69
·
评论数0

AI是如何学会“成事”的?本期节目,我们将看到,AI如何通过处理办公室杂活,竟然领悟了解决复杂问题的底层心法。我们还会揭秘一套神奇的“管家系统”,看它如何防止聪明的AI在长任务中掉链子。但与AI聊得太久,为何反而会陷入危险的“妄想旋涡”?最后,当任务完成,AI又是如何精准地判断出,哪一步才是真正的功臣?

00:00:29 成事的底层心法,AI学会了,我们呢?

00:06:12 你的AI为什么总掉链子?因为它缺个好管家

00:12:07 为什么和AI聊得越久,就越危险?

00:18:45 功劳怎么算?AI学会了“动态归因”

00:25:15 AI生成,从“万里长征”到“瞬间移动”

本期介绍的几篇论文:

[AI] Post-Training on Office Work Improves Software Engineering: A Behavioral Account of Cross-Domain Transfer
[Surge AI]
arxiv.org
---
[CV] LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks
[DreamX Team, Alibaba Group]
arxiv.org
---
[CL] DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots
[Stanford University]
arxiv.org
---
[AI] AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning
[Tsinghua University & Zhejiang University]
arxiv.org
---
[LG] Beckmann Transport Models: From Autonomous Flows to One-Step Maps
[Harvard University & Capital Fund Management & University of Oxford]
arxiv.org