EP120 · Bun 借 AI 重写、Hook 治理、Nemotron 登顶 · 07-17 早报BestBlogs

EP120 · Bun 借 AI 重写、Hook 治理、Nemotron 登顶 · 07-17 早报

13分钟 ·
播放数41
·
评论数0

章节时间戳

  • 00:00 开场

  • 00:47 精讲:Bun 作者用 Fable 把 53 万行 Zig 重写为 Rust

  • 03:31 精讲:腾讯 DECO 用框架 Hook 堵住 LLM 偷懒与越权

  • 06:35 精讲:NVIDIA Nemotron 3 Embed 登顶 RTEB 检索榜

  • 09:26 速览:Inkling、Kimi K3、Computer-Use 2.0、Lychee-FD、State Lake

  • 11:46 补充阅读:原力灵机 DW0.5、HYPIC、MiniMax Code 2.0、AI 人才战、语义事务

  • 12:48 结语

★ 精讲一 | The Pulse:从 Bun 借助 AI 快速重写为 Rust 我们能学到什么?

00:47|来自 The Pragmatic Engineer

Bun 作者 Jarred Sumner 用 Anthropic 的 Fable 模型,在 11 天里花费 16.5 万美元,把 53.5 万行 Zig 代码重写为内存安全的 Rust,把原本预计要一年的重构压缩到两周。关键不在于一句提示词,而是 3 小时移植规范、对抗式评审和 64 个并行智能体的工程编排——让过去认为不可能的大规模重写变得现实可行。

★ 精讲二 | Agent 治理:用 Hook 堵住 LLM 的偷懒、越权与失忆

03:31|来自 腾讯技术工程

腾讯数仓 Agent 平台 DECO 总结 LLM 三类顽疾——长脚本偷懒截断、危险操作越权、改表后失忆。核心结论是在 prompt 里写禁止根本管不住,解法是在框架 Hook 切面上做代码级强制:长内容落盘、HITL 门禁、上下文联动补齐盲区,并把基础设施与推理逻辑解耦。

★ 精讲三 | NVIDIA Nemotron 3 Embed 在 RTEB 上排名第一,推动智能体检索发展

06:35|来自 Hugging Face - Blog

NVIDIA 开源嵌入模型族 Nemotron 3 Embed,8B 版以 78.5% 登顶 RTEB 检索榜,并配 1B 与 Blackwell 专属 NVFP4 版本(吞吐翻倍、保留 99% 以上精度)。更关键的价值在智能体一侧:更准确的检索让证据更早出现,智能体不必反复搜索、少绕几轮推理,直接压低下游 token 成本,是 RAG 与智能体记忆共同的检索底座。

速览

09:26 更多值得关注的内容

· Thinking Machines 发布开源多模态大模型 Inkling — Hugging Face - Blog

· Kimi K3,以及我们从鹈鹕基准测试中仍能学到的东西 — Simon Willison's Weblog

· Computer-Use 2.0:从屏幕操控迈向后台智能体 [视频] — AI Engineer

· Lychee-FD 全双工语音大模型斩获 ACL 2026 杰出论文 — 机器之心

· Physical Intelligence 柯丽一鸣 4 小时访谈:Pi 开源模型与机器人的江湖 [播客] — 张小珺 Jùn|商业访谈录

· 从 Data Lake 到 State Lake:面向 Agent 时代的存储基础设施重构 — 字节跳动技术团队

· 一文讲透 Skill — 腾讯云开发者

补充阅读

11:46 今天额外值得一读的几条

· 用世界模型给 VLA 当教练,原力灵机发布 DW0.5,把 RL 搬进虚拟世界 — 量子位

· 首 token 延迟降 3.25 倍!小红书联合北大、上交提出 HYPIC,让混合注意力大模型用上「位置无关缓存」 — 小红书技术 REDtech

· MiniMax Code 2.0 焕新,底层架构全面升级 — MiniMax 稀宇科技

· AI 人才战最疯的一年:HR 盯论文抢人,秋招大幅提前,顶级毕业生第一站该去哪儿? — 机器之心

· 9.9 元/月,用 AgentPlan + OpenViking 给销售团队配一个不会忘事的 AI 助手 — 字节跳动技术团队

· 语义事务:在 OS 运行时边界保护不可信的智能体工作流 — Hacker News - Newest: 「AI Agent」

相关链接

· 本期早报在线阅读:www.bestblogs.dev

· The Pulse:从 Bun 借助 AI 快速重写为 Rust 我们能学到什么?:www.bestblogs.dev

· Agent 治理:用 Hook 堵住 LLM 的偷懒、越权与失忆:www.bestblogs.dev

· NVIDIA Nemotron 3 Embed 在 RTEB 上排名第一,推动智能体检索发展:www.bestblogs.dev

· Thinking Machines 发布开源多模态大模型 Inkling:www.bestblogs.dev

· Kimi K3,以及我们从鹈鹕基准测试中仍能学到的东西:www.bestblogs.dev

· Computer-Use 2.0:从屏幕操控迈向后台智能体 [视频]:www.bestblogs.dev

· Lychee-FD 全双工语音大模型斩获 ACL 2026 杰出论文:www.bestblogs.dev

· Physical Intelligence 柯丽一鸣 4 小时访谈:Pi 开源模型与机器人的江湖 [播客]:www.bestblogs.dev

· 从 Data Lake 到 State Lake:面向 Agent 时代的存储基础设施重构:www.bestblogs.dev

· 一文讲透 Skill:www.bestblogs.dev

· 用世界模型给 VLA 当教练,原力灵机发布 DW0.5,把 RL 搬进虚拟世界:www.bestblogs.dev

· 首 token 延迟降 3.25 倍!小红书联合北大、上交提出 HYPIC,让混合注意力大模型用上「位置无关缓存」:www.bestblogs.dev

· MiniMax Code 2.0 焕新,底层架构全面升级:www.bestblogs.dev

· AI 人才战最疯的一年:HR 盯论文抢人,秋招大幅提前,顶级毕业生第一站该去哪儿?:www.bestblogs.dev

· 9.9 元/月,用 AgentPlan + OpenViking 给销售团队配一个不会忘事的 AI 助手:www.bestblogs.dev

· 语义事务:在 OS 运行时边界保护不可信的智能体工作流:www.bestblogs.dev

关于 BestBlogs

BestBlogs 是 AI 驱动的私人阅读助手,帮助你发现真正适合你的高质量内容,关注你感兴趣的来源和主题,每天生成一份更适合自己的「我的早报」,欢迎体验和关注我们。

关注我们