中国开源,从跟随到领跑全球红衣大叔周鸿祎的播客

中国开源,从跟随到领跑全球

42分钟 ·
播放数576
·
评论数1

一、本期主持

吴姗姗

红衣客厅主持人。本期她替听众把 OpenRouter 榜单、开放权重、主权AI 这些硬概念逐段追问明白,也让周总把这堂开源大课从头讲透。

二、本期节目简介

OpenRouter 最新周榜:调用量前十名,6 个模型来自中国。DeepSeek 稳居第一,把排名最高的美国闭源模型甩开一倍多。Hugging Face 的 CEO 说,中国的开源 AI 已经占据主导地位。

周鸿祎说,这个结果他两年前就预言过:中国赢不了硬件,也还没赢在刷榜,真正的胜负手是开源生态。这一期没有嘉宾,只有红衣大叔一个人,把「开源为什么能赢」从头讲到尾。

为什么开源是「免费打败收费」的故事,互联网早就用 Linux 和 MySQL 演过一遍?为什么开源模型会成为全球大模型的「根技术」,像 CPU 一样被各国拿去造自己的电脑?什么是开放权重,为什么「开放程度有高低」是个误解?从国家的主权AI 1.0、企业的 2.0,到个人专属大模型的 3.0,这条线怎么一步步走通?扎克伯格为什么声援开源,OpenAI 和 Anthropic 又在为谁筑墙?

他还算了一笔账:跑满血版 DeepSeek 的设备现在要 6 万元,两年内会降到 1 万元。到那天,你家里会有一台只属于你的大模型,你才敢把全部数据交给它。

美国拦不拦得住开源?他的答案是 Be water。谁拿到开源AI,谁就拿到未来。你站哪边?

三、专业词汇注释

OpenRouter:聚合了全世界各大模型调用接口的平台,开发者接入后可以自由切换使用哪个模型。它的周调用榜单不代表全部流量,但能看出模型市场占有率的趋势。

开放权重:把训练完成的大模型本身(内部由大量向量组成的权重网络)开放出来,任何人可以拿走、部署在自己的服务器上。大模型一般不开放训练源码,因为拿到源码没有算力也训不出来,用户真正需要的是模型本身。

私有化部署:把大模型部署在自己控制的内网或服务器上,数据不出网。对保密、数据隐私有要求的单位和敏感领域是刚需。

后训练:拿成熟的开源模型,用自己的数据继续训练,把通用模型调制成自己的专用模型。

主权AI:自主可控的 AI。周总把它拆成三个阶段:1.0 是国家层面的主权大模型;2.0 是企业私有化部署、把内部知识训练进去;3.0 是企业专有大模型加专属智能体与工具,成为懂行业、懂业务的数字员工。

端侧大模型:跑在本地设备上的模型,如汽车、家用机器人、个人服务器。断网可用、数据不出门,是未来具身智能的标配。

Llama:Meta 开源的模型系列。周总评价 Llama 3 发布对中国开源事业是「沙漠里送来的一杯水」,把很多关键技术给大家看了个明白。

红帽模式:Red Hat Linux 的商业模式:软件本身免费,服务收费。周总类比为「送手机、收话费」,是开源商业化的经典路径。

蒸馏:用成熟模型生成的高质量数据去训练新模型。数据质量决定模型水平,所以应用场景越多、数据越丰富的一方,模型越强。

过程数据:人类解决问题的过程,比如老师讲解方程的推导步骤、主任医师的诊疗思路。周总认为这是「死记硬背的知识」之后,训练数据的下一个富矿。

 

四、时间轴导航

00:00 「前十名里,6 个来自中国」

OpenRouter 周榜开场:DeepSeek 第一、前十占六,甩开美国闭源模型一倍多;周总说自己两年前就预言过这个结果,中国赢不了硬件、还没赢在刷榜,胜负手是开源生态。

01:05 「它有点像当年的网站统计」

周总科普 OpenRouter:聚合全世界模型的调用接口,榜单不代表全部流量,但能看出市场趋势。

02:03 「免费打败收费」

互联网靠 Linux、MySQL、PHP 这些开源软件撑起来;有私有化部署需求的单位不可能把闭源模型搬回家,开源模型几乎等于免费。

03:27 「开源的四张牌」

影响力与知名度、道德制高点、用户反馈加速进化、二次开发成为别人技术的底层。规模足够大,开源模型就有机会成为全球大模型的「根技术」。

06:28 「挣小钱的人理解不了」

DeepSeek 梁总的 AGI 愿景;技术大神参与开源图的是自我实现,挣的是无形的荣誉与江湖地位。

08:26 「送手机,收话费」

红帽模式:产品免费、服务收费;开源起初比闭源差,靠便宜、可改、用户多慢慢追上。开源战胜闭源,靠的是完整生态。

10:17 「问计不问心」

不管出于什么动机,开源降低了整个国家数字化、智能化的成本。没有 DeepSeek,大家还在百模大战、重复造轮子。

11:05 「误解得很对」

开放权重是把训练好的模型本身给你,不存在「开放程度高低」。两个人听到「苹果」想到的东西不同,就是两个模型、两套权重。

13:27 「美国为什么不开源了」

美国在大模型时代放弃了开源;Llama 3 给中国送来「沙漠里的一杯水」。黄仁勋转发公开信,A16Z 一直呼吁美国拿回开源 AI 的领导权。

15:35 「坐在餐桌边,还是被端上餐桌」

一带一路国家渴望主权AI:闭源模型的水龙头在别人手里;中国的开源模型装在自己服务器上,知识产权归自己,安全可控。

16:59 「主权AI 1.0、2.0、3.0」

国家主权模型,到企业私有化部署(律所、医院、金融、国防的数据不出网),再到把专有知识训成专业大模型,AI 才真正落户百行千业。

22:50 「刮胡子的时候,刀不能失控」

汽车和机器人用不了云端模型;端侧大模型的市场规模可能是云端的 100 倍甚至 1000 倍。

25:27 「敢把全部数据交给它」

周总预计两年内万元设备就能跑 DeepSeek 满血版;家里有了一台私有大模型,数字分身才敢收纳你的全部数据,用得越久它越懂你。

28:28 「不想给美国政府做高参」

OpenAI 和 Anthropic 渲染 AI 危险,一是证明自己的 AI 从会编程进化到会写攻击代码、水平更高,二是为垄断闭源铺路;扎克伯格发文声援开源:科技平权,防止技术被少数公司垄断。

33:33 「谁获得开源AI,谁就获得未来」

世界各国为什么选中国开源模型:安全、便宜、知识产权归自己。暗数据、过程数据是训练数据的下一站,应用场景越多,模型越强。

37:02 「再亲也不如钱包亲」

美国 500 强 CEO 的账:一年 1 亿美金的闭源 API,还是 1000 万美金的算力加私有化部署?答案用脚趾头想都知道。

38:32 「Be water」

美国政府只卡了 GPU,再来封开源已经晚了;开源像水一样无处不在、没有中枢,拦不住。

40:21 「Codex 开源的野心」

OpenAI 开源 Codex,是希望各家 Agent 平台都长在它的技术上。开源是战略,不能当成战术玩。

41:45 「开源一定会战胜闭源」

结尾总结:美国巨头押注闭源、用资本和算力筑墙;中国主流选择开源、用生态和协作破壁。分享才能掌握主动权,你站哪边?

展开Show Notes
周总好。我在你们纳米Ai,怎么登录不可了??什么都没了?怎么回事?