【0924 | AI日报】Claude新版任务成本降四成/Snorkel获3.5亿美元融资

【0924 | AI日报】Claude新版任务成本降四成/Snorkel获3.5亿美元融资

9分钟 ·
播放数201
·
评论数0

早安!

我们的配套AI资讯网站【AI圈儿】已正式上线,大家可以点击链接访问

aidailynews.com.cn

欢迎添加+vx:KyroMa(管理员),加入听友群

今天是2026年9月24日,星期四

欢迎查收你的每日AI资讯速递!今日内容如下:

⏰【AI时间线】

今天的时间线我们来“盘”一下从反复提醒,到让模型学会纠错。

👉【今日重点新闻】

新闻一:Anthropic发布Opus 5.5,典型任务成本下降四成
根据官方说明,Opus 5.5在默认设置下,典型工作负载成本较Opus 5降低百分之四十,输出速度提升超过百分之三十。这里的四成是任务成本降幅,输入和输出token单价分别下降两成,不能混作同一个数字。官方发布说明

新闻二:Snorkel AI完成三点五亿美元融资,扩展训练数据服务
Snorkel AI完成E轮融资,估值升至三十五亿美元。公司从提供数据标注工具,转向交付训练数据集和合成数据,报告的年化收入运行率达三点七五亿美元。业务变化显示,模型训练需要的不仅是数据数量,也包括可直接使用的数据服务。

新闻三:阿里将全模态统一生成列为未来三年技术方向
阿里在云栖大会上提出全模态统一生成的发展规划,希望进一步打通文本、图像、视频和音频创作。相关技术已进入影视创作者的尝试范围,不过,技术路线的宣布与成熟产品的全面落地仍有距离,后续需要关注实际能力和使用体验。

🙇‍♀️【AI资讯简报】

03:46 在发布 / 更新方面:

一、Google Gemma分享djev部署工具,可通过一条命令在Cloud Run启动兼容Jev API的端点,用于实验DiffusionGemma。公布的单步延迟为三十五到六十毫秒,三十二批量配置下吞吐量约每秒一百到一百二十三个请求,具体表现取决于测试条件。

二、AWS推出基于Strands Evals和Bedrock AgentCore的智能体评估方案,重点检查技能选择和指令遵循。比如,系统有没有调用正确的领域技能,执行过程是否符合要求,帮助开发者定位那些“回答听起来不错,事情却没办对”的问题。

三、SageMaker AI新增并发扫描功能,可以自动测试生成式AI端点在不同负载下的表现。开发者通过接口发起测试,观察请求增加后性能如何变化,再决定需要多少计算资源,为容量规划提供量化依据。

04:51 在研究 / 技术突破方面:

一、Perplexity提出提示引导自我蒸馏方法,通过学习成功步骤,并借助验证提示纠正错误来改进模型。团队报告,A/B测试中的工具调用失败率相对下降百分之二十一点二。另一项提示条件下的指标,也从百分之七十五点一提升至九十三点七,两者不能混为同一口径。

二、据密码研究网站记录,GPT-6 Astra解开了编号为MVUEH的二战Enigma密文。模型编写Python和C++工具,构建模拟器及搜索程序,并利用可能出现的地名作为线索完成解密。这个案例展示的是历史密码分析能力,不能直接推及现代加密系统。

05:42 在合作 / 商业部署方面:

TechCrunch Disrupt 2026安排了五场AI安全专题会议,涉及企业Claude部署、智能体防护和云安全架构。Anthropic、Okta、AWS和NVIDIA等公司高管将参与,重点讨论AI从实验走向生产环境时遇到的实际问题。

06:07 在政策 / 法律 / 监管方面:

希腊总理在旧金山谈到,政府对AI带来的变化仍准备不足。据报道,希腊正推进数字基础设施和AI超级计算机建设,并制定面向聊天机器人的监管政策。这也提出一个现实问题:基础设施投入和治理能力建设,能否同步推进。

🤔【AI深一度】06:47

Perplexity的提示引导自我蒸馏,可以理解为给模型整理“错题本”:保留成功步骤,借助验证提示纠正错误,再让模型从这些过程中学习。团队报告工具调用失败率相对下降百分之二十一点二,但这一结果有具体测试条件。

关键在于,修正过程必须经过可靠验证。参数错误、权限不足和服务故障,需要不同处理;不能把碰巧成功的一次重试全盘当作示范。留下失败原因、有效提醒和验证结果,才有机会让一次纠正成为后续任务能复用的经验。

🔍 【找到我们】

音频平台:苹果播客,喜马拉雅

社交媒体:小红书,抖音

公众号:Kyro AI Tech

网站:AI圈儿