
## 今日精讲
00:35 Mistral 发布 Voxtral TTS 语音模型,并展望 Mistral 4
Mistral AI 推出首款语音生成模型 Voxtral TTS,基于 3.8B 参数骨干网络,支持九种语言,质量媲美 ElevenLabs 但成本更低且权重开放。采用自回归语义 token 与声学 token 流匹配的独特架构。同时介绍了 Forge 微调平台和精简版 Leanstral。
03:14 阿里发布 Qwen3.5-Omni,多模态能力超越 Gemini-3.1 Pro
阿里新一代全模态大模型 Qwen3.5-Omni 在 215 项音视频任务中超越 Google Gemini-3.1 Pro。支持 113 种语言方言,具备音视频结构化描述和 Vibe Coding 能力。通过阿里云百炼平台提供三种 API 版本,每百万 tokens 输入不足 0.8 元,仅为竞品十分之一。
05:24 Claude 5.0 惊现内测:90 分钟攻破 20 年 Linux 漏洞与 Anthropic 开发范式转型
Anthropic 秘密测试的下一代模型 Claude Mythos 5.0 在编程和安全方面展现跨代级性能。安全研究员 Nicholas Carlini 演示了 Claude 在 90 分钟内自主发现并利用了 Ghost CMS 的 SQL 注入漏洞和 Linux 内核中潜伏 20 年的缓冲区溢出漏洞。更值得关注的是 Anthropic 内部工程师角色的转变:从手写代码转向管理多个并行 AI 智能体。
## 速览
08:01 更多值得关注的内容
· Google 发布 ADK for Java 1.0.0:将智能体生态扩展到 Java — Google Developers Blog
· 微软为 M365 Copilot 推出「Critique」和「Council」多模型协作功能 — @satyanadella
· 认知重建之后,步入 Agentic Engineering 的工程革命 — 腾讯技术工程
· 从 Vibe Coding 到范式编程:用 Spec 打造淘系交易的 AI 领域专家 — 大淘宝技术
· Perplexity AI 构建语音智能体的经验分享:基于 Realtime API — @OpenAIDevs
· 利用 AI 营销获取你的前 1000 位客户 [视频] — Greg Isenberg
· Chip Huyen:当感觉没有什么可构建时,我们为什么还要继续构建 [视频] — The Pragmatic Engineer
## 相关链接
· Mistral 发布 Voxtral TTS 语音模型,并展...:www.bestblogs.dev
· 阿里发布 Qwen3.5-Omni,多模态能力超越 Gemi...:www.bestblogs.dev
· Claude 5.0 惊现内测:90 分钟攻破 20 年 L...:www.bestblogs.dev

