013|让AI做题,它却去研究怎么作弊:OpenAI这次发生了什么?

013|让AI做题,它却去研究怎么作弊:OpenAI这次发生了什么?

31分钟 ·
播放数8
·
评论数0

本来让AI做题,它却开始研究怎么骗过评分,还跟其他AI“传纸条”、分享找到的钥匙,最后入侵了Hugging Face的系统。聊到OpenAI这起安全事件,朋友觉得:这会不会又是资本在讲故事、制造恐惧?我做过程序员,看到这些细节,却没法一笑而过。尤其是那句“目标是人定的,所以AI还是可控的”,我越想越觉得,里面少了一步。

这一期《峰言峰语|想说就说》,我把报告里的过程讲成一个非程序员也能听懂的故事:AI为什么要绕出去,为什么找上Hugging Face,所谓“牺牲自己”又是怎么回事。讲到后面,担心的事情离我自己越来越近:代码让AI写,出错让AI查,连安不安全也问AI。最后那个确认按钮确实是我点的,可我凭什么判断它说得对?这让我想起自己当年怎么从程序员一步步做成架构师,也冒出了一个问题:活都交给AI以后,下一批有判断力的人,怎么练出来?

内容时间线

00:03 跟朋友的一场分歧:AI入侵事件,会不会只是资本的故事?

02:26 从5月的网盘任务到7月的入侵:AI为什么绕出去,又为什么找上Hugging Face?

13:22 AI互相协作,甚至“牺牲自己”:这些听起来像科幻的行为是什么?

16:50 把投诉入口藏起来,也能拿高分?从强化学习说到目标与过程的失控

20:57 AI提方案,人来判断:我们会不会成为“末代架构师”?

26:46 回看三方报告:一件事能被拿来宣传,不等于事情就是编的

——————————

主播:蓝华峰Frank

ICF PCC教练、创始人教练、高管教练、企业咨询顾问、一人公司实践者。曾任迪士尼全球副总裁、Hulu北京研发中心总经理,有两次创业经历。

现在主要陪伴已经有一定业务基本盘的创始人和核心高管,帮助他们把情绪、人情、机制、边界和责任拆开,看清真正的问题与选择。

个人网站:lanhuafeng.com