【26.8.27】小米把120B模型搬上桌面,AI开始争夺本地算力

【26.8.27】小米把120B模型搬上桌面,AI开始争夺本地算力

10分钟 ·
播放数57
·
评论数0

【26.8.27】小米把120B模型搬上桌面,AI开始争夺本地算力

小米展示 AI Cube 桌面原型机,把三颗玄戒芯片、80GB 统一内存和本地 120B+3B 双模型装进一台设备。

MiniMax 财报、Qwen/GLM 稀疏模型和中国 AI 安全标准,正在把行业从参数竞争拉回成本与责任。

Waymo、Google Cloud、Anthropic 和 TRACE 则给出同一个海外信号:AI 进入真实工作后,必须可计费、可审计,也要给错误留下第二道防线。

本期坐标

• 内容主题:模型与产品

• 主要地域:中国 / 全球 / 海外

• 辅助主题:应用与产业、治理安全与社会

时间轴

00:03 小米 AI Cube:120B 模型搬上桌面

02:12 MiniMax:收入增长与亏损同时扩大

03:21 Qwen 与 GLM:为什么都在降低激活参数

04:22 TC260:AI 安全能力开始走向分级评估

05:19 Anthropic:本地代码和办公会话进入合规审计

06:03 Waymo:两亿英里后仍保留多传感器冗余

06:59 Google Cloud:Agent 成本不能只看 token 单价

07:55 TRACE:跨云智能体需要可验证证据链

09:05 今日总结

事实边界

• 已确认事实:MiniMax 财报已发布;Qwen、GLM 权重与官方说明已上线;TC260 正在征求意见;Anthropic、Waymo、Google Cloud 与 TII 均已发布对应官方更新。

• 公司自述:小米 AI Cube 的配置、150W 持续性能释放及双模型能力来自公开展示,尚无独立完整测试;Waymo 的两亿英里与经验总结属于公司运营口径。

• 媒体报道:小米 AI Cube 使用新浪和 IT之家互证,证据等级 B。公开的 295 tokens/s 属于另一台 O3+O100 手机形态原型机,不是 AI Cube 的 120B 模型速度。

• 主播判断:AI 竞争正在从发布会参数进入采购、成本、审计与责任的现实检验。

• 待核验:AI Cube 的价格、上市时间、120B 模型身份、量化方式和实际生成速度。

直接来源

小米 AI Cube 公开信息转录(2026-08-24)

www.sina.cn

MiniMax 2026 年上半年财报(2026-08-26)

www.minimax.io

Qwen3.8-Flash-Next(2026-08-26)

qwen.ai

GLM-5.3-Flash(2026-08-26)

z.ai

TC260 人工智能安全能力成熟度评估方法征求意见(2026-08-26)

www.tc260.org.cn

Claude Platform Release Notes(2026-08-26)

platform.claude.com

Waymo:2 亿英里后的十条 AI 经验(2026-08-26)

waymo.com

Google Cloud Agent 计费与成本管理(2026-08-26)

cloud.google.com

TRACE 可验证 AI 开放标准(2026-08-26)

www.tii.ae

数字口径

• 120B、3B、80GB 与 150W:小米原型机公开展示口径。

• 295 tokens/s:另一台 O3+O100 手机形态原型机运行小米 MiMo 端侧模型,不属于 AI Cube。

• MiniMax 收入与调整后净亏损:公司上半年财报口径。

• Qwen/GLM 参数:总参数与每 token 激活参数不是同一成本口径。

下一观察点:小米是否公布 AI Cube 的产品化时间、售价、真实任务速度和离线能力。

勘误:如发现事实或口径需要修正,将在本节更新。

评论问题:如果本地 AI 设备和云端订阅价格接近,你更愿意把工作资料留在哪一边?

主播:施泰隆

本节目由施泰隆主编,音频使用 AI 合成声线制作,并经过人工编辑与核验。