2026.09.04 | 终端环境可由轨迹重建;模型后训练需审慎迁移

2026.09.04 | 终端环境可由轨迹重建;模型后训练需审慎迁移

15分钟 ·
播放数32
·
评论数0

【赞助商】
OpenClaw快报
每天五分钟,听听 OpenClaw 快报,带你了解最新动态和业内讨论
传送门 www.xiaoyuzhoufm.com

【目录】
本期的 15 篇论文如下:

[00:33] 🌌 Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments(终端宇宙:将智能体轨迹转化为可扩展的终端环境)
[01:31] 🚦 Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training(知道何时不该复用:自主大语言模型后训练中的条件经验迁移)
[02:34] 🎨 LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes(LLaDA-Image:以完全开放的训练配方构建强大图像生成器)
[03:33] 🧠 LatentPress: Context Compression Beyond Text and Vision(LatentPress:超越文本与视觉的上下文压缩)
[04:20] 🧠 Compile by Training: Turning Natural-Language Specifications into Local Neural Functions(通过训练进行编译:将自然语言规范转化为本地神经函数)
[05:12] 🎲 Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning(随机注意力:重新思考面向高效推理的KV缓存淘汰)
[06:19] ⚡ Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM(为什么门控DeltaNet能在4比特量化下存活:面向混合27B大语言模型循环半部分的NVFP4 W4A4量化)
[07:15] 🎯 Rethinking On-Policy Distillation of Large Language Models II: One Training Example(重新思考大语言模型的同策略蒸馏(二):一个训练示例)
[08:18] 🌍 Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States(Puffin-World:以原生3D世界状态扩展统一多模态模型)
[09:17] 🧩 Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction(Scal3R:学习高效多相对位姿查询以实现可扩展的在线三维重建)
[10:09] 🎨 Editable Visual Design(可编辑视觉设计)
[11:08] ⏱ The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation(缺失的时间链接:用于脚本驱动的音视频生成的时间上下文路由)
[11:58] 🧠 Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding(超越检索:用于流式视频理解的渐进式潜在记忆演化)
[12:50] 🧩 CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation(CORE:通过重排序器蒸馏提升多模态大语言模型嵌入的组合推理)
[13:47] 🤖 RealSWE: A Compositional Evaluation of Coding Agents under Realistic User Requests(RealSWE:真实用户请求下编码智能体的组合式评估)

【关注我们】
您还可以在以下平台找到我们,获得播客内容以外更多信息
小红书: AI速递