

AI Agent 论文播报·2026-07-14这是 AI Agent 论文播报 在 2026-07-14 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * BatteryLake: Agentic, Physics-Grounded Curation of Heterogeneous Battery Aging Data and Benchmarking * NetInjectBench: Benchmarking Indirect Prompt Injection in Tool-Using Large Language Model Agents for Network Operations * A Multi-Agent Framework for Zero-Dimensional Reduced-Order Model Planning ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-14这是 AI Agent 论文播报 在 2026-07-14 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * BatteryLake: Agentic, Physics-Grounded Curation of Heterogeneous Battery Aging Data and Benchmarking * NetInjectBench: Benchmarking Indirect Prompt Injection in Tool-Using Large Language Model Agents for Network Operations * A Multi-Agent Framework for Zero-Dimensional Reduced-Order Model Planning ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-13这是 AI Agent 论文播报 在 2026-07-13 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution * Mosaic: Runtime-Efficient Multi-Agent Embodied Planning * LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-10这是 AI Agent 论文播报 在 2026-07-10 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * Out of Sight: Compression-Aware Content Protection against Agentic Crawlers * CausalDS: Benchmarking Causal Reasoning in Data-Science Agents * Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-09这是 AI Agent 论文播报 在 2026-07-09 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * A Closed-Loop Multi-Agent Framework for Robust Multi-Robot Manipulation * Reliable and Developer-Aligned Evaluation of Agents for Software Engineering * Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-09这是 AI Agent 论文播报 在 2026-07-09 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * A Closed-Loop Multi-Agent Framework for Robust Multi-Robot Manipulation * Reliable and Developer-Aligned Evaluation of Agents for Software Engineering * Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-08这是 AI Agent 论文播报 在 2026-07-08 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * Beyond the Leaderboard: A Synthesis of Tool-Use, Planning, and Reasoning Failures in Large Language Model Agents * GEM-Occ: From Visual Geometry Evidence to Embodied Semantic Occupancy Memory * KAT-Coder-V2.5 Technical Report ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-07这是 AI Agent 论文播报 在 2026-07-07 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * PiSAs: Benchmarking Contextual Integrity in Multi-User Agentic Systems * Homer: Understanding Long-form Videos with Hierarchical Memory and Agentic Reasoning * Agentic SABRE: An Uncertainty-Aware Neuro-Symbolic Multi-Agent Framework for Adaptive Ransomware Detection ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-07这是 AI Agent 论文播报 在 2026-07-07 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * PiSAs: Benchmarking Contextual Integrity in Multi-User Agentic Systems * Homer: Understanding Long-form Videos with Hierarchical Memory and Agentic Reasoning * Agentic SABRE: An Uncertainty-Aware Neuro-Symbolic Multi-Agent Framework for Adaptive Ransomware Detection ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-03这是 AI Agent 论文播报 在 2026-07-03 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents * Atomic Task Graph: A Unified Framework for Agentic Planning and Execution * Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-03这是 AI Agent 论文播报 在 2026-07-03 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents * Atomic Task Graph: A Unified Framework for Agentic Planning and Execution * Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-02这是 AI Agent 论文播报 在 2026-07-02 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * ATM: CID-Brokered Pre-Write Admission for Multi-Agent Code Co-Synthesis * Leveraging LLM-Based Agentic Systems to Generate Quantum Applications for Test Optimization * PHREEQC-MCQ-200: A Diagnostic Benchmark for Tool-Augmented Scientific Simulator Agents ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-02这是 AI Agent 论文播报 在 2026-07-02 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * ATM: CID-Brokered Pre-Write Admission for Multi-Agent Code Co-Synthesis * Leveraging LLM-Based Agentic Systems to Generate Quantum Applications for Test Optimization * PHREEQC-MCQ-200: A Diagnostic Benchmark for Tool-Augmented Scientific Simulator Agents ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-01这是 AI Agent 论文播报 在 2026-07-01 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * AgRefactor: Self-Evolving Agentic Workflow for HLS Compatibility and Performance * MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning * Investigating Multi-Agent Deliberation in Law ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']
AI Agent 论文播报·2026-07-01这是 AI Agent 论文播报 在 2026-07-01 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 * AgRefactor: Self-Evolving Agentic Workflow for HLS Compatibility and Performance * MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning * Investigating Multi-Agent Deliberation in Law ['Agent 研究继续从模型能力转向执行链与系统边界。', '更值得追踪的是评测、约束、协议和运行时设计。']