Jev 模型创始人:我参与做出了 ChatGPT,现在我在构建下一代的东西

Jev 模型创始人:我参与做出了 ChatGPT,现在我在构建下一代的东西

13分钟 ·
播放数303
·
评论数0

这是 TypeSafe AI 创始人兼 CEO Diogo AlmeidaAI Engineer World's Fair 2026 上的一场主题演讲。他是 OpenAI 那篇奠定 ChatGPT 基础的 RLHF 论文(InstructGPT)的合著者,也是 GPT-4 技术报告的共同作者——换句话说,他正是那个"教 ChatGPT 说话的人"。而他此番登台,却是来宣告自己亲手参与搭建的这套体系走上了弯路。

演讲的核心,是对当前大模型训练范式的一次正面挑战。Diogo 指出,RLHF 优化的目标从来不是客观真理,而是"貌似合理"和"取悦人类的说服力"。模型的不懂装懂、过度自信与幻觉,不是 bug,而是这套机制刻意练出来的特性。这就造成了一个行业性的分裂:在"人在环中"的辅助场景里,RLHF 体系极其强大;但一旦进入真正的自动化场景——比如让模型独立处理客服退款、信用审批——企业根本不敢放手,因为它无法给出可信的置信度。

在 Diogo 看来,Claude Code 与 ChatGPT 其实属于同一个时代,都还没跨过"真正自动化"的门槛。破局的方向是转向可验证奖励的强化学习(RLVR/RLCD),因为只有当奖励机制实现客观自动化,任务才可能实现自主自动化。这也呼应了萨顿《苦涩的教训》的结论:针对任务的算力搜索,比堆砌人类偏好数据更重要。

配合演讲,TypeSafe AI 同期发布首个"系统一"决策模型 Jev,"教 ChatGPT 说话的人"开始造一个"不说话的模型",正是这场演讲引爆讨论的原因。

原视频链接:www.youtube.com