今日精讲
DeepSeek-V4 预览版正式发布:百万上下文成标配,1.6 万亿参数普惠开源
今日精讲 ①:时隔五个月 DeepSeek 一次甩出 V4-Pro(1.6T/49B)和 V4-Flash(284B/13B)两款 MoE 预览版,1M 上下文成为所有官方服务标配,并配上 CSA 4 倍 + HCA 128 倍的混合稀疏注意力,把长文 Agent 的算力和显存都压到 V3.2 的 27% 与 10%。Pro Agentic Coding 评测达到开源最佳,公司内部反馈优于 Sonnet 4.5、接近 Opus 4.6 非思考模式;Flash 在简单任务追平 Pro,且只需 13B 激活。定价分别是 Flash 0.14/0.28 美元、Pro 1.74/3.48 美元每百万 token,明确瞄准华为昇腾国产芯片。开源大模型的「能力 + 成本」前线被一次推到新位置。
来自 DeepSeek
深度解析 Hermes Agent 自进化:Skill 生成 + RL 训练双轨闭环
今日精讲 ②:阿里云开发者继 OpenClaw、Claude Code 之后写出系列第三篇,深扒 Nous Research 的 Hermes Agent。这个项目在七周内 GitHub Star 突破十万、增速行业第二,原因不在功能堆料,而在自进化机制。Hermes 同时跑两条进化路径:一是动态 Skill 生成——每次复杂任务结束后启动后台审查 Agent,把踩坑、纠错、验证过的最佳实践抽象成可复用的 Skill 文件;二是 DSPy + GEPA 驱动的 RL 训练闭环,把外部记忆的「记笔记」上升到模型权重的「练内功」。文章逐行拆 _skill_nudge_interval = 10 计数器、_spawn_background_review 异步审查、记忆/技能/综合三视角的 prompt 设计——是当下市面上对「Agent 长期运行如何积累能力」最具体的中文工程拆解。
来自 阿里云开发者
腾讯混元 Hy3 preview 开源:295B/21B MoE,押注「同尺寸性价比 + 工程落地」
今日精讲 ③:DeepSeek 主打开源极致,腾讯混元同一周用 Hy3 preview 走另一条路——295B 总参 / 21B 激活、256K 上下文,不在参数尺寸上和万亿模型死磕,把工程性价比写成产品语言。训练只跑了不到三个月,是姚顺雨 2025 年底加入腾讯主导重建后的首发模型。API 输入 1.2 元、输出 4 元每百万 token、个人版 28 元/月,处于同尺寸开源旗舰最低价梯队;推理效率整体提升 40%。文章给出三条令人信服的内部数据:WorkBuddy 同尺寸国内模型盲评胜率 56%、AIPPT 生成成功率 +20% 耗时 -20%、腾讯新闻较真模式响应时间 1/5。配上刘炽平在财报电话会的话——「AI 是许多比赛构成的集合」、汤道生「AI 落地不是算法题是工程题」,整个故事就是腾讯版本的「不追总参数最大,追业务可交付」。
来自 腾讯科技
速览
更多值得关注的内容
· 对话罗福莉 3.5 小时:AI 范式从 Pre-train 转向 Post-train,卡的分配 3:1:1 [播客] — 张小珺 Jùn|商业访谈录
· 800 行代码实现 Open Claw:Tool / 消息总线 / 子 Agent 的薄抽象工程 — 大淘宝技术
· 阮一峰周刊 394 期:第二次 API 开放浪潮——平台被 Agent 倒逼放权 — 阮一峰的网络日志
· 把大模型推向亿级 DAU 前台:快手直播如何重构匹配效率与互动智能体 — InfoQ 中文
· Cursor 即将被收购、Figma 股价大跌:模型厂商还会吃掉哪些应用? — Founder Park
· 中美 AI 创业生态差异:对谈 Google Cloud 北亚区创投生态负责人 [播客] — 屠龙之术
· 对话小米陈龙:90 后 AI 当家、车与机器人打通的 Physical AI 世界观 [播客] — 卫诗婕|商业漫谈 Jane's talk
更多推荐
今天额外值得一读的六条
· 一文读懂 DeepSeek V4:1.6 万亿参数、百万上下文、华为芯片 — 腾讯科技
· Cat Wu 面试了几百个 PM 候选人,几乎没人答对一个问题:AI 产品经理到底应该干什么? — 宝玉的分享
· Altman、Brockman 十年来首次同台:砍掉 Sora 不是因为它不够好,第一优先级是 Agent — Founder Park
· 当互联网用 AI 卷效率时,这家公司先问了一连串“能不能” — InfoQ 中文
· 162: 中国最早 AI 创业者的故事,与唐文斌聊天才策略、旷视、十年前的机器人和具身新创业 [播客] — 晚点聊 LateTalk
· Nature 封面:机器人乒乓球干翻人类职业选手 — 量子位
相关链接
· DeepSeek-V4 预览版正式发布:百万上下文成标配,1.6 万亿参数普惠开源:www.bestblogs.dev
· 深度解析 Hermes Agent 自进化:Skill 生成 + RL 训练双轨闭环:www.bestblogs.dev
· 腾讯混元 Hy3 preview 开源:295B/21B MoE,押注「同尺寸性价比 + 工程落地」:www.bestblogs.dev
· 对话罗福莉 3.5 小时:AI 范式从 Pre-train 转向 Post-train,卡的分配 3:1:1 [播客]:www.bestblogs.dev
· 800 行代码实现 Open Claw:Tool / 消息总线 / 子 Agent 的薄抽象工程:www.bestblogs.dev
· 阮一峰周刊 394 期:第二次 API 开放浪潮——平台被 Agent 倒逼放权:www.bestblogs.dev
· 把大模型推向亿级 DAU 前台:快手直播如何重构匹配效率与互动智能体:www.bestblogs.dev
· Cursor 即将被收购、Figma 股价大跌:模型厂商还会吃掉哪些应用?:www.bestblogs.dev
· 中美 AI 创业生态差异:对谈 Google Cloud 北亚区创投生态负责人 [播客]:www.bestblogs.dev
· 对话小米陈龙:90 后 AI 当家、车与机器人打通的 Physical AI 世界观 [播客]:www.bestblogs.dev
· 一文读懂 DeepSeek V4:1.6 万亿参数、百万上下文、华为芯片:www.bestblogs.dev
· Cat Wu 面试了几百个 PM 候选人,几乎没人答对一个问题:AI 产品经理到底应该干什么?:www.bestblogs.dev
· Altman、Brockman 十年来首次同台:砍掉 Sora 不是因为它不够好,第一优先级是 Agent:www.bestblogs.dev
· 当互联网用 AI 卷效率时,这家公司先问了一连串“能不能”:www.bestblogs.dev
· 162: 中国最早 AI 创业者的故事,与唐文斌聊天才策略、旷视、十年前的机器人和具身新创业 [播客]:www.bestblogs.dev
· Nature 封面:机器人乒乓球干翻人类职业选手:www.bestblogs.dev
· BestBlogs: bestblogs.dev

