EP.82 · 7×24 全球AI速报 · 2026-09-03(周四)

EP.82 · 7×24 全球AI速报 · 2026-09-03(周四)

7分钟 ·
播放数40
·
评论数0

Meta 发布 Muse Spark 1.3,五个月内第四个版本,Artificial Analysis 智能指数 xhigh 变体得 61 分排第三,在 Claude 与 GPT 之间;长上下文 MRCR 256K-512K 得分 98.5 超过 GPT-5.6 Sol 的 91.5;比 1.2 版减少 20% 工具调用和 25% token 消耗。[1]

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber,六周内第三款 Flash 模型;标准版推理更努力但 token 用量可能更高,定价维持每百万输入 0.75 美元、输出 3.75 美元;Cyber 版主打安全缺陷检测与自动修复,配套 Fairwind 计划做主动防御。[2]

美国司法部就 OpenAI 与纽约时报版权诉讼提交意见书,主张用版权文本训练大语言模型一般应属合理使用,以国家安全为由警告全面许可要求会削弱美国 AI 竞争力;该意见书属建议性质、不约束法院。[3]

Claude Code 和 Cowork 新增后台操作电脑功能,用户把任务交给 Claude 后可同时做别的事;Pro 和 Max 套餐 beta 版,仅限 macOS。[4]

Cursor 推出 Self-Hosted Machines,云智能体的工具执行迁移到企业自有网络,推理仍走云端,Cursor 不会主动连入企业网络。[5]

Anthropic 开源 commerce-agents 电商智能体参考实现,基于零售、旅游、电信等场景经验,核心是单个 Claude 在标准循环中配合技能与工具,含购物与商家 Agent 蓝图。[6]

通义千问发布 Qwen3.8-Max-0902,Code Arena WebDev 首次亮相以 1691 分登顶总榜第一,定价 5 美元每百万 token 位于 Pareto 前沿最高分。[7]

Perplexity 开源本地推理引擎 Lily,专为 Apple silicon 优化 Qwen3.6-35B-A3B,解决 Perplexity Computer 混合计算的设备端算力瓶颈。[8]

Inworld 发布 Realtime TTS-2 正式版,登顶 Artificial Analysis Controlled Voice Arena,支持 5-15 秒音频克隆声音,verbatim 标签可准确读出订单号和代码;同期推出低延迟 TTS-2 Flash。[9]

## Sources

[1] x.com — Meta Muse Spark 1.3 发布

[2] deepmind.google — Gemini 3.8 Flash 与 Flash Cyber

[3] the-decoder.com — DOJ 版权合理使用意见书

[4] x.com — Claude Cowork 后台操作

[5] cursor.com — Cursor Self-Hosted Machines

[6] claude.com — Anthropic 电商 Agent 架构

[7] x.com — Qwen3.8-Max-0902

[8] x.com — Perplexity Lily 开源

[9] x.com — Inworld TTS-2 GA