【赞助商】
OpenClaw快报
每天五分钟,听听 OpenClaw 快报,带你了解最新动态和业内讨论
传送门 www.xiaoyuzhoufm.com
【目录】
本期的 15 篇论文如下:
[] 🌌 Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments(终端宇宙:将智能体轨迹转化为可扩展的终端环境)
[] 🚦 Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training(知道何时不该复用:自主大语言模型后训练中的条件经验迁移)
[] 🎨 LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes(LLaDA-Image:以完全开放的训练配方构建强大图像生成器)
[] 🧠 LatentPress: Context Compression Beyond Text and Vision(LatentPress:超越文本与视觉的上下文压缩)
[] 🧠 Compile by Training: Turning Natural-Language Specifications into Local Neural Functions(通过训练进行编译:将自然语言规范转化为本地神经函数)
[] 🎲 Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning(随机注意力:重新思考面向高效推理的KV缓存淘汰)
[] ⚡ Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM(为什么门控DeltaNet能在4比特量化下存活:面向混合27B大语言模型循环半部分的NVFP4 W4A4量化)
[] 🎯 Rethinking On-Policy Distillation of Large Language Models II: One Training Example(重新思考大语言模型的同策略蒸馏(二):一个训练示例)
[] 🌍 Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States(Puffin-World:以原生3D世界状态扩展统一多模态模型)
[] 🧩 Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction(Scal3R:学习高效多相对位姿查询以实现可扩展的在线三维重建)
[] 🎨 Editable Visual Design(可编辑视觉设计)
[] ⏱ The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation(缺失的时间链接:用于脚本驱动的音视频生成的时间上下文路由)
[] 🧠 Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding(超越检索:用于流式视频理解的渐进式潜在记忆演化)
[] 🧩 CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation(CORE:通过重排序器蒸馏提升多模态大语言模型嵌入的组合推理)
[] 🤖 RealSWE: A Compositional Evaluation of Coding Agents under Realistic User Requests(RealSWE:真实用户请求下编码智能体的组合式评估)

【关注我们】
您还可以在以下平台找到我们,获得播客内容以外更多信息
小红书: AI速递
