你方唱罢我登场,城头变换大王旗
AI 进化论

你方唱罢我登场,城头变换大王旗

9分钟 72 1周前
节目简介
来源:小宇宙
00:15
今天的博客咱们来讨论一下,最近这个人工智能领域发生的几个比较大的事件。然后我们也会聊一聊现在在人工智能这个领域里面,基础设施开源和闭源的生态,以及监管和商业策略。这几个比较关键的因素是如何互相影响,并且开始左右这个AI产业的走向的。
00:37
是啊这个确实是现在整个行业都非常关注的问题。那我们就直接开始。
01.AI 监管-美国管AI 出新招:管得住自家,管不住别人
00:42
咱们先来讲讲最近炒的比较火的一个话题,就是美国对于人工智能的监管最近出台了一些新的举措。那为什么美国政府会这么着急,想要对这些顶级的AI模型进行安全体检呢?
00:57
其实主要的原因就是因为最近这个AI的能力提升的太快了,而且已经有这种OpenAI和Anthropic他们的模型在测试的时候就已经出现了这种越狱的情况,就是他会自己黑进别的公司的系统,所以这个就会让白宫非常的紧张。
01:13
看来这个测试的时候都已经这么危险了,那实际应用当中还得了。
01:18
没错。所以政府就把OpenAI、Anthropic、谷歌、Meta这四大公司叫过去,说以后你们这些顶级的模型在发布之前都要先经过30天的安全体检。对,但是这个体检是自愿的,然后标准是不公开的。最妙的是开源的模型还不用剪,所以像中国的这些千问、Kimi、GLM全都不在这个范围之内。
01:40
既然提到了中国的开源模型,那我就想问了,为什么现在美国的企业会越来越多的去选择用这些中国的开源的AI模型?
01:49
这个原因很简单,就是因为中国的这些开源的模型。比如说GLM5.2和阿里的Qwen还有这个Kimi它不光是比Claude、GPT便宜60%到90%,而且它还非常的好用。比如说这个GLM5.2,它上线了一个礼拜用量就暴增了27倍。然后Airbnb都已经开始用Qwen了,Cursor甚至直接就是基于Kimi做了他们自己的模型。
02:15
这么一看的话,这个价格差距确实很有诱惑力。但是我在想会不会还有一些其他的原因,让这些企业更倾向于选择中国的开源模型。
02:24
当然有了,还有一个很重要的原因就是数据安全。因为很多硅谷的公司,他们都很担心把自己的商业数据、客户信息或者是代码交给OpenAI、Anthropic这些闭源的模型。他们会担心这些巨头公司会反手用这些数据来跟他们竞争。但是如果你用的是开源的模型的话,你就可以把模型下载下来自己部署。然后你的数据就可以完全留在自己的服务器里面,根本就不用送出去。所以甚至连微软的CEO纳德拉都在说,企业要掌控自己的数据主权。
02:54
所以说现在美国在对这个AI模型进行监管的时候,会带来一些什么样意想不到要的后果。
03:00
其实现在美国对自己本土的这些闭源的模型管得越紧,反而给了这些中国的开源的模型更多的机会。因为中国的这些模型又便宜,又不用经过安全审查,然后又不会动你的数据,所以很多美国的公司都更愿意去用这些模型。
03:17
听起来好像美国政府的这种监管反而有点帮对手铺路的感觉。
03:22
可不是。而且最有意思的是,现在最厉害的那些开源的模型基本上都是中国的。然后美国的政府好像更担心的是本土的公司形成垄断,对于中国的这些AI企业去抢占市场份额这件事情反而没有那么紧张。就像那个Brookings 研究员Kyle Chan说的,最强开源模型与最强中国模型高度重合。这届政府好像更害怕美国出现闭源垄断,而不怕中国AI来抢生意。
02.AI 定价-DeepSeek 要涨价了:先把你喂胖,再收饭钱
03:48
说完了美国对AI的监管,咱们再来说说AI的定价。就是最近DeepSeek突然宣布要大幅的提高API的价格。这个事情其实背后是有很多原因的那我们就来分析一下,为什么DeepSeek会有底气突然之间就把价格涨上去?
04:06
这个底气是来源于DeepSeek-V4 Flash这个模型的正式发布。因为这个模型在Agent能力的测试上面拿到了25.2的分数,非常接近Anthropic最厉害的那个Opus-4.8(25.7 分),。但是它的运行成本要比Claude Fable 5低2个数量级。
04:26
这就难怪大家都在用DeepSeek了。对,这性能差不多,但是便宜这么多,谁不用谁傻。
04:33
确实,所以全球的开发者都涌过来用,然后它的单日token处理量在8月1号这一天就飚到了8万亿。甚至连GLM5.2这个模型在上线的第一周也有27倍的token量的增长。但是也因为这样,所以DeepSeek大部分的流量其实都是在免费试用的阶段。它虽然服务器压力巨大,但是收入其实是非常有限的。
04:56
既然现在DeepSeek这么火,那为什么DeepSeek还要学互联网行业那一套,先低价吸引用户,然后再慢慢的涨价。
05:05
其实这背后的原因很简单,就是因为他们在高峰时段接口经常会超时,然后服务器压力太大了。所以他们在七月中旬的时候就已经推出了峰谷定价,就是高峰时段价格翻倍。但是这还不够,所以他们现在就干脆直接全面的调高价格。
05:22
那大家肯定就会担心了,说我现在已经习惯了用这么便宜的服务。那这个价格一涨起来,大家会不会就集体的跳槽去其他的平台?
05:30
这一点其实不用担心。因为DeepSeek其实跟其他的那些互联网公司还不太一样,就是它的这个模型是完全开源的。所以你如果觉得涨价之后难以接受,你可以直接把权重下载下来自己部署。而且就算它涨价之后,它的价格依然是比Claude要便宜几十倍的,所以其实用户的选择空间并不大,这就是他们敢涨价的最大的底气。
03.太空算力-AI 太费电了,人类决定把机房搬上天
05:51
然后我们接下来要聊的就是太空算力对最近AI基础设施短缺的问题非常严重。大家都在说要把数据中心搬到太空去,那这个到底是怎么回事呢?
06:02
因为现在训练一个大型的AI模型,它的耗电量是非常夸张的,就真的跟一个小城市差不多。然后全球的这些科技巨头,他们又在疯狂的建数据中心,所以他们之间就是在互相抢地抢水。甚至有一些地方的居民都在抱怨说AI把我的电都抢走了,我夏天都开不了空调。
06:23
这听起来确实有点夸张,但是我想问一下,就是把数据中心搬到太空上去到底有哪些好处?
06:30
最大的好处就是太空上面有取之不尽的太阳能。然后它是一个天然的真空环境,就非常有利于散热,而且它完全不占用地球上的任何土地资源。所以现在其实美国和中国都已经在投入大量的资源去推动这件事情了。
06:46
那现在美国和中国在太空算力这方面都有哪些具体的大动作?
06:50
美国的话就是SpaceX已经公布了他们的AI算力卫星的设计,它的翼展有70米,然后它的太阳能阵列可以提供150千瓦的电力,单颗卫星的算力就可以媲美一套英伟达的GB300地面机柜。对,然后他们还计划要发射100万颗卫星,要在近地轨道上面组建一个轨道数据中心。谷歌的话他们也有一个补日者计划,他们打算在2027年的时候发射带有TPU芯片的原型卫星。
07:22
美国这是下了血本,那中国这边有哪些突破呢?
07:25
中国的话就是成都国星宇航,他们在推进星算计划,他们是要发射2800颗卫星来组建一个覆盖全球的太空算力网络。然后北京这边的话是计划在700到800公里的晨昏轨道上面建造超级瓦级的太空数据中心,而且他们要部署百万卡级的服务器集群,并且今年的四月份太空算力专业委员会也已经成立了,北京的太空算力创新中心也正式启动筹建了。
07:55
不过现在虽然说大家都在太空算力这个赛道上面你追我赶的,但是这个事情在技术上面和成本上面到底有哪些难以逾越的难题?
08:05
现在最大的问题就是发射的成本还是太高了。中国现在差不多是5万元每公斤,但你要真的做到规模化的话,你可能要降到0.5万元每公斤,这中间还差了整整一个数量级。
08:17
除了发射成本这个拦路虎之外,电力供应是不是也是一个特别大的挑战?没错。
08:23
因为你要给这个太空里面的数据中心提供兆瓦级的电力的话,你可能需要一个平方千米级的太阳意,这在工程上面的实现难度是非常高的。但是不管怎么说,就是地球上的资源总是有限的,所以谁能够率先的把算力送上太空,谁就能够掌握未来AI基础设施的主导权。所以现在其实这个芯片战争还没有结束,新一轮的太空算力竞赛其实已经拉开帷幕了。
08:53
今天我们聊了美国的这个AI监管的新的玩法,然后又聊了开源闭源的这种生态之争,又聊了这个AI公司的一些定价的套路,最后我们还聊了太空算力这个事情。其实这背后都指向了一个非常关键的转变,就是大家争夺的焦点已经不再是单纯的模型能力了。而是真正的落到了谁能够以更低的成本,更安全可靠的、更可持续的方式去搭建起这个AI的基础设施。
09:24
今天的节目咱们就到这里了,感谢大家的收听,咱们下期再见,拜拜。

加入我们的 Discord

与播客爱好者一起交流

立即加入

扫描微信二维码

添加微信好友,获取更多播客资讯

微信二维码

播放列表

自动播放下一个

播放列表还是空的

去找些喜欢的节目添加进来吧