【0917|AI日报】Gemini语音成本降档/阿里Wan3.0升级/DeepSeek补强CFO

【0917|AI日报】Gemini语音成本降档/阿里Wan3.0升级/DeepSeek补强CFO

10分钟 ·
播放数212
·
评论数0

早安!

我们的配套AI资讯网站【AI圈儿】已正式上线,大家可以点击链接访问

aidailynews.com.cn

欢迎添加+vx:KyroMa(管理员),加入听友群

今天是2026年9月17日,星期四

欢迎查收你的每日AI资讯速递!今日内容如下:

⏰【AI时间线】

今天的时间线我们来“盘”一下Agent从“接得上”到“用得住”。

👉【今日重点新闻】

新闻一:Google DeepMind发布Gemini 3.8 Live语音模型,基准测试排名第一

Google DeepMind发布Gemini 3.8 Live语音模型,在Artificial Analysis语音对话基准测试中以82.6%的得分位居首位。该模型支持超97种语言,每小时语音对话成本约1.38美元,远低于OpenAI的至少3美元。Google采用半双工通信,而OpenAI的GPT-Live-1使用全双工技术,后者对话自然度更优。

新闻二:阿里云发布Wan3.0视频生成模型:动作一致性和分辨率大幅提升

阿里云发布Wan3.0视频生成模型,从Wan 2.1到2.2再到3.0实现跨越性升级,在动作一致性、创作控制和分辨率等方面大幅提升对创作者更加友好,并提供Model Studio和Qwen Cloud等API访问渠道。

新闻三:DeepSeek聘请高瓴创投合伙人严文韬担任CFO,加速商业化布局

DeepSeek创始人梁文锋聘请高瓴创投合伙人严文韬担任CFO。严文韬1991年生,曾主导投资智谱、MiniMax等AI公司,此次加入意味着DeepSeek在完成模型技术突破后开始补强资本运营与商业化能力,加速从纯研究向商业化过渡。接下来是今天的AI资讯速递。

🙇‍♀️【AI资讯简报】

04:13 在发布与更新方面:

一、OpenAI确认,GPT-5.5虽然将退出ChatGPT等产品,但仍会继续通过API平台和Codex提供访问。对于现有API用户来说,模型不会立刻消失,不过后续仍需要按照平台安排迁移到新的模型版本。

二、Meta发布WhatsApp Business Tools MCP服务器,让Claude、Cursor、Codex等AI Agent能够自动处理WhatsApp Business账号创建、模板设计和故障排查。过去需要开发者逐项配置的流程,现在进一步向自然语言驱动的Agent操作转移。

04:55 在研究与技术突破方面:

一、IBM Research把Agent评估里一个很容易被忽略的问题摆到了台面上。以GPT-4.1为例,平均成功率达到77.4%,但能够连续5次全部成功的任务只有53%。团队因此开发Consistency Analyzer定位容易发生结果翻转的决策点,并将一致性差距从24.4个百分点降低到12个百分点左右。

二、Google公布多项AI科研进展。AlphaGenome Atlas绘制了覆盖90亿种人类基因变异的图谱;WeatherNext 3被介绍为目前最准确的全球天气AI模型;Google翻译则扩展到接近300种语言,覆盖约70亿人口。

05:47 在投融资与并购方面:

前TikTok员工创办的Superpose完成220万美元融资。这款iOS应用利用生成式AI分析自拍和照片,为用户自动生成4个拍照姿势建议。产品7月上线以来已经获得超过2.2万次下载,并生成19万多个姿势建议。

06:12 在合作与商业部署方面:

高通、中兴努比亚和豆包助手合作推出努比亚NaviX Ultra AI智能体手机,基于骁龙8至尊版芯片推动终端侧Agent能力落地。这也意味着手机厂商、芯片公司和AI应用开始进一步绑定,争夺个人AI助手这一入口。

06:37在政策 / 法律 / 监管方面:

一、英伟达CEO黄仁勋在Dreamforce大会上表示,AI安全本质上是可以通过硬件和软件解决的工程问题,并认为市场力量可以推动企业自律,不需要增加新的监管法规。不过相关报道同时以CrowdStrike宕机和Meta诉讼为例,指出单纯依靠市场自律也可能存在局限。

🤔【AI深一度】07:21

AI Agent正在遇到一个比“能力够不够强”更现实的问题:稳定性。

IBM Research发现,以GPT-4.1为例,Agent平均成功率达到77.4%,但要求一个任务连续运行5次全部成功时,比例只有53%。这说明“平均表现很好”和“每次都值得信任”完全不是一回事。

原因也不复杂。Agent执行的任务往往包含多个步骤,每一个决策点都可能产生小偏差,而流程越长,这些偏差越容易累积。IBM的Consistency Analyzer因此不只看最终答案,而是定位哪些决策最容易发生结果翻转。

随着Meta用MCP把Agent接入企业服务,高通、努比亚和豆包把Agent装进手机,行业真正需要回答的问题也变了。

未来Agent的成绩单,可能不只看它最好的一次有多聪明,更要看第100次运行时,它还能不能把同一件事做好。

🔍 【找到我们】

音频平台:苹果播客,喜马拉雅

社交媒体:小红书,抖音

公众号:Kyro AI Tech

网站:AI圈儿