【0830 | AI日报】OpenAI切断Cursor/法院判Anthropic黑名单违法

【0830 | AI日报】OpenAI切断Cursor/法院判Anthropic黑名单违法

8分钟 ·
播放数57
·
评论数0

早安!

我们的配套AI资讯网站【AI圈儿】已正式上线,大家可以点击链接访问

aidailynews.com.cn

欢迎添加+vx:KyroMa(管理员),加入听友群

另外,我们与京东图书合作为大家带来了很多优质的人工智能领域的图书资源,欢迎大家访问主会场获取专属优惠 u.jd.com

今天是2026年8月30日,星期日

欢迎查收你的每日AI资讯速递!今日内容如下:

⏰【AI时间线】

今天的时间线我们来“盘”一下从公开跑分到双盲测试,AI评测开始隐藏考题。

👉【今日重点新闻】

OpenAI切断Cursor模型合作
OpenAI以服务条款风险为由终止与Cursor合作,Cursor回应称OpenAI模型仅占其AI流量的5%,双方仍在寻找解决方案。

Lambda举债10亿美元采购AI芯片
Lambda获得10亿美元短期债务融资,将购买Nvidia芯片并租赁给微软。2026年全球AI相关债务融资已超过4000亿美元。

法院判Anthropic黑名单违法
美国联邦法院认定五角大楼将Anthropic列入供应链风险黑名单违反第一修正案,但相关技术性限制尚未完全解除。

🙇‍♀️【AI资讯简报】

发布/更新

04:05 GitHub Copilot发布5项新功能更新:集成Slack/Teams、支持Gemini 3.7 Flash和Kimi K3等模型

04:27 Anthropic 为 Claude Code 桌面应用新增会话恢复功能

04:41 智谱AI发布GLM-5.3开源权重模型:代理编程与网络安全专用

研究/技术突破

05:07 Google DeepMind推出双盲评估方法解决AI基准测试信任危机

05:23 OpenRouter分析:GPT 5.6模型折扣后使用量激增13.8倍

05:44 研究发现:AI代理可自动化生成漏洞利用代码 将利用时间压缩至补丁发布前

合作/商业部署

06:14 智谱 GLM-5.3-Flash 宣布上线 Ollama 云端平台

🤔【AI深一度】06:39

大模型排行榜过去看起来很直观:大家做同一套题,分数越高,能力越强。但随着公开题目可能进入训练数据,模型答对问题,究竟来自现场推理还是提前见过答案,已经越来越难判断。

Google DeepMind提出的双盲评估方案,是把模型和题目放进受保护的计算环境。评测方看不到模型权重,模型方也无法提前接触题库,最终只输出经过授权的结果。

这套方案无法消除所有偏差,但可以减少泄题、数据污染和针对性调参。今后的排行榜还需要公开运行环境、工具权限、推理预算和成本。考试过程足够透明,模型分数才真正具有参考价值。

🔍 【找到我们】

音频平台:苹果播客喜马拉雅

社交媒体:小红书抖音

公众号:Kyro AI Tech

网站:AI圈儿