中国开源,从跟随到领跑全球
红衣大叔周鸿祎的播客

中国开源,从跟随到领跑全球

42分钟 519 2周前
节目简介
来源:小宇宙
一、本期主持
吴姗姗
红衣客厅主持人。本期她替听众把 OpenRouter 榜单、开放权重、主权AI 这些硬概念逐段追问明白,也让周总把这堂开源大课从头讲透。
二、本期节目简介
OpenRouter 最新周榜:调用量前十名,6 个模型来自中国。DeepSeek 稳居第一,把排名最高的美国闭源模型甩开一倍多。Hugging Face 的 CEO 说,中国的开源 AI 已经占据主导地位。
周鸿祎说,这个结果他两年前就预言过:中国赢不了硬件,也还没赢在刷榜,真正的胜负手是开源生态。这一期没有嘉宾,只有红衣大叔一个人,把「开源为什么能赢」从头讲到尾。
为什么开源是「免费打败收费」的故事,互联网早就用 Linux 和 MySQL 演过一遍?为什么开源模型会成为全球大模型的「根技术」,像 CPU 一样被各国拿去造自己的电脑?什么是开放权重,为什么「开放程度有高低」是个误解?从国家的主权AI 1.0、企业的 2.0,到个人专属大模型的 3.0,这条线怎么一步步走通?扎克伯格为什么声援开源,OpenAI 和 Anthropic 又在为谁筑墙?
他还算了一笔账:跑满血版 DeepSeek 的设备现在要 6 万元,两年内会降到 1 万元。到那天,你家里会有一台只属于你的大模型,你才敢把全部数据交给它。
美国拦不拦得住开源?他的答案是 Be water。谁拿到开源AI,谁就拿到未来。你站哪边?
三、专业词汇注释
OpenRouter:聚合了全世界各大模型调用接口的平台,开发者接入后可以自由切换使用哪个模型。它的周调用榜单不代表全部流量,但能看出模型市场占有率的趋势。
开放权重:把训练完成的大模型本身(内部由大量向量组成的权重网络)开放出来,任何人可以拿走、部署在自己的服务器上。大模型一般不开放训练源码,因为拿到源码没有算力也训不出来,用户真正需要的是模型本身。
私有化部署:把大模型部署在自己控制的内网或服务器上,数据不出网。对保密、数据隐私有要求的单位和敏感领域是刚需。
后训练:拿成熟的开源模型,用自己的数据继续训练,把通用模型调制成自己的专用模型。
主权AI:自主可控的 AI。周总把它拆成三个阶段:1.0 是国家层面的主权大模型;2.0 是企业私有化部署、把内部知识训练进去;3.0 是企业专有大模型加专属智能体与工具,成为懂行业、懂业务的数字员工。
端侧大模型:跑在本地设备上的模型,如汽车、家用机器人、个人服务器。断网可用、数据不出门,是未来具身智能的标配。
Llama:Meta 开源的模型系列。周总评价 Llama 3 发布对中国开源事业是「沙漠里送来的一杯水」,把很多关键技术给大家看了个明白。
红帽模式:Red Hat Linux 的商业模式:软件本身免费,服务收费。周总类比为「送手机、收话费」,是开源商业化的经典路径。
蒸馏:用成熟模型生成的高质量数据去训练新模型。数据质量决定模型水平,所以应用场景越多、数据越丰富的一方,模型越强。
过程数据:人类解决问题的过程,比如老师讲解方程的推导步骤、主任医师的诊疗思路。周总认为这是「死记硬背的知识」之后,训练数据的下一个富矿。
四、时间轴导航
⏰ 00:00 「前十名里,6 个来自中国」
OpenRouter 周榜开场:DeepSeek 第一、前十占六,甩开美国闭源模型一倍多;周总说自己两年前就预言过这个结果,中国赢不了硬件、还没赢在刷榜,胜负手是开源生态。
⏰ 01:05 「它有点像当年的网站统计」
周总科普 OpenRouter:聚合全世界模型的调用接口,榜单不代表全部流量,但能看出市场趋势。
⏰ 02:03 「免费打败收费」
互联网靠 Linux、MySQL、PHP 这些开源软件撑起来;有私有化部署需求的单位不可能把闭源模型搬回家,开源模型几乎等于免费。
⏰ 03:27 「开源的四张牌」
影响力与知名度、道德制高点、用户反馈加速进化、二次开发成为别人技术的底层。规模足够大,开源模型就有机会成为全球大模型的「根技术」。
⏰ 06:28 「挣小钱的人理解不了」
DeepSeek 梁总的 AGI 愿景;技术大神参与开源图的是自我实现,挣的是无形的荣誉与江湖地位。
⏰ 08:26 「送手机,收话费」
红帽模式:产品免费、服务收费;开源起初比闭源差,靠便宜、可改、用户多慢慢追上。开源战胜闭源,靠的是完整生态。
⏰ 10:17 「问计不问心」
不管出于什么动机,开源降低了整个国家数字化、智能化的成本。没有 DeepSeek,大家还在百模大战、重复造轮子。
⏰ 11:05 「误解得很对」
开放权重是把训练好的模型本身给你,不存在「开放程度高低」。两个人听到「苹果」想到的东西不同,就是两个模型、两套权重。
⏰ 13:27 「美国为什么不开源了」
美国在大模型时代放弃了开源;Llama 3 给中国送来「沙漠里的一杯水」。黄仁勋转发公开信,A16Z 一直呼吁美国拿回开源 AI 的领导权。
⏰ 15:35 「坐在餐桌边,还是被端上餐桌」
一带一路国家渴望主权AI:闭源模型的水龙头在别人手里;中国的开源模型装在自己服务器上,知识产权归自己,安全可控。
⏰ 16:59 「主权AI 1.0、2.0、3.0」
国家主权模型,到企业私有化部署(律所、医院、金融、国防的数据不出网),再到把专有知识训成专业大模型,AI 才真正落户百行千业。
⏰ 22:50 「刮胡子的时候,刀不能失控」
汽车和机器人用不了云端模型;端侧大模型的市场规模可能是云端的 100 倍甚至 1000 倍。
⏰ 25:27 「敢把全部数据交给它」
周总预计两年内万元设备就能跑 DeepSeek 满血版;家里有了一台私有大模型,数字分身才敢收纳你的全部数据,用得越久它越懂你。
⏰ 28:28 「不想给美国政府做高参」
OpenAI 和 Anthropic 渲染 AI 危险,一是证明自己的 AI 从会编程进化到会写攻击代码、水平更高,二是为垄断闭源铺路;扎克伯格发文声援开源:科技平权,防止技术被少数公司垄断。
⏰ 33:33 「谁获得开源AI,谁就获得未来」
世界各国为什么选中国开源模型:安全、便宜、知识产权归自己。暗数据、过程数据是训练数据的下一站,应用场景越多,模型越强。
⏰ 37:02 「再亲也不如钱包亲」
美国 500 强 CEO 的账:一年 1 亿美金的闭源 API,还是 1000 万美金的算力加私有化部署?答案用脚趾头想都知道。
⏰ 38:32 「Be water」
美国政府只卡了 GPU,再来封开源已经晚了;开源像水一样无处不在、没有中枢,拦不住。
⏰ 40:21 「Codex 开源的野心」
OpenAI 开源 Codex,是希望各家 Agent 平台都长在它的技术上。开源是战略,不能当成战术玩。
⏰ 41:45 「开源一定会战胜闭源」
结尾总结:美国巨头押注闭源、用资本和算力筑墙;中国主流选择开源、用生态和协作破壁。分享才能掌握主动权,你站哪边?

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧