世界太吵,来原声听播客

科技乱炖

英伟达没有垄断只有先发优势,赚走九成钱就等着被挖地基

英伟达的护城河是 CUDA 那层软件加硬件领先,但它没形成垄断。毛利越高,大模型厂商自己造芯片的动力就越大——砍这一铲子甚至是为了向资本市场交代。

算力英伟达GPU 黑市企业 AI产品设计

原视频在 YouTube 上放不出来,用音频听:

前半段 GPU 黑市细节密度高,后半段 AI 改写产品逻辑有真判断;中间模型评测部分可快进。

核心论点 · 点时间戳可跳到原声

1:01

赚走九成钱,代价是所有人都想挖你

英伟达的护城河是软硬结合:硬件是 GPU,软件是 CUDA 那层中间层,在人类编程和 GPU 之间当桥梁。但它没有形成垄断,只是形成了领先的先发优势。问题在于,你跑得特别快、拿了全世界百分之九十的钱,代价就是所有人都想把你这个钱结了,后面一堆人拿着枪追你。而且毛利越高,大家追的动力就越大。大模型厂商本身有提高毛利率的诉求,无论降本还是增效,压到一定程度,这把刀自然会砍到英伟达的生态上——哪怕只是试试砍一刀。

3:49

砍这一铲子是为了向资本交代

为什么大模型厂商明知难也要自研芯片?这不只是技术选型问题,甚至是一个如何向资本市场交代的问题。我要铲这一铲子,是要告诉资本市场我在试图做这件事,我没有举手投降、被唯一的生态垄断。亚马逊和谷歌已经证明自己造芯片可行,规模越大省的钱越多。所以 OpenAI 也宣布要做自己的芯片,评测成绩叫墨西哥辣椒。但这事钱太多——OpenAI 说要花四百五十亿美元去租算力,四百五十亿能不能自己造?可能不够。

6:01

一台八卡服务器国内现货一千四百万

以现在比较先进的 B300 服务器为例,配置四 T 内存,八个卡一台,国内现货价一千四百多万人民币。同一台机器在美国只要五十多万美金,合人民币六七百万,翻了三倍。成本高有多重原因:美国政府出口管制,所谓防守就是防止你运出来。你在美国亚马逊下单送到硅谷家中可以,但出境不行——需要 KYC,不能是中国,还要有 IDC 证明。机器辗转重重造假运到东南亚比如泰国,基本就翻一倍,再从泰国突破重重防守进内地,两边都走一遍,翻两倍。

10:10

五百一十二台交货要插电点亮五百一十二次

现货交易像房子一样,一般按二的 n 次方数卖:两台、四台、八台、一百二十八台、二百五十六台。有人碰到五百一十二台要七十多亿。交易流程是:先要你截图银行账户证明真有钱,那边也要拍视频证明真有货,念公司名、拿当天的报纸。交货时一台一台交,插电点亮就表示好的,打钱,一台拉走,下一台再来,重复五百一十二次,差不多要一天——因为点亮一台拔卡的服务器需要半天。阿里融的八百亿港币,也就够买五千台。

11:28

期货全是假的,现货七成是中介

期货满天飞的询价里,八百万的报价比一千四百万的现货便宜,但没人敢干,现在要全款信用证。信用证就是银行出的担保,可以理解成古早版纸质版支付宝,用于大宗货物贸易,还要配第三方仓库:货放进第三方仓库,仓单给银行,银行看见仓单打款,买家再拿仓单去仓库提货。但现在的玩法是:买家出全额信用证,卖家拿信用证和买家资料去银行抵押,拿钱去买货。所以期货百分之百全是假的——只要到货、没有赔偿风险、直接卖现货,谁不干?现货也估计有百分之七十是假的,卖家七成是中介。

19:21

一千四百万的机器跑什么才能回本

算一笔账:一千四百万买八个卡,跑训练一台两台肯定不够,起码得几百台;跑推理,买 token 才多少钱?什么时候回本?之前说十个月回本,现在已经下降了。有人看到 DeepSeek 上市的新闻,说大模型厂商利润率挺高,好像能达到百分之六七十——但没算投入,服务器也没算,硬件资产按摊销算,加上机房、电、维护成本,可能算个六七十的毛利。关键是有没有源源不断的可撰写内容把卡跑满。很多生意不赚钱,是因为闲置时间太多,就跟饭馆一样,二十四小时都能坐满,利润率也很高。

24:44

国产 GPU 跑出顶流模型,英伟达先跌后涨

智谱发了 GLM 5.3 Flash,评分不第一,但基本追上了 Opus 4.8,宣称进入顶流队列。最重要的不是评分,而是文章里说:我们的算力是在国产 GPU 上跑的,经过优化,国产 GPU 的计算效率已经赶上了海外 GPU 产品的效率。这句话就火了。发新闻的时间点也坏,赶上晚上开发的时候。英伟达昨天跌得不多,今天涨了百分之六点几。市场现在要么极度乐观要么极度悲观,一个消息就严重影响走向,过两天又回来。

31:42

模型分两端:创造力用最贵,重复劳动用最便宜

现在模型盲测看不出区别,大家开始选价格。但企业端实际分成两个场景:创造力驱动的场景,比如写代码、做长程分析出报告,再便宜也不会用,一定用顶级的,因为有太高的沉默成本,做坏了再跑一遍不值得,时间和成本都浪费了。另一种是内容分析这类工作,产出直接决定企业营收,一定选 ROI 更合理的模型。就像雇人:雇保洁,月薪一万的再好也觉得不需要,最便宜里找个及格的就行;雇工程师,就愿意付更高薪资买创造力。两头,站中间就两边不靠。

39:14

官网是给 AI 读的,字多反而是优势

有个报告说百分之七十互联网流量已经都是 AI 了。如果官网是给 AI 读的,就必须写复杂点,把信息给全,才能在 GEO 角度占优势。以前做 SEO 是堆关键词,但 AI 不看这些,它总结不出来就略过去,你必须用相对复杂完整的叙事逻辑写明白,不怕字儿多,怕你没覆盖到。技术上,原先的动态页面不好使了,AI 在端侧抓只能抓到空页面,必须用 SSR 后端渲染,把内容全放在 HTML 里一次性返回。还有一种做法:大模型会发送可接收内容类型的头信息,如果是 TXT 加 markdown,就回一个纯 markdown,里面没有任何能引起幻觉的东西。

原话 · 已逐字校验

这不是一个技术选型的问题,这甚至是一个如何向资本市场交代的问题。

这不是一个技术选型的问题,甚至是一个如何向资本市场交代的问题。

所以现在这个市场第一期货全是假的,百分之百全是假的,就是不可能是真的。因为他转手就拿现货卖了。

所以现在这个市场,第一期货全是假的,百分之百全是假的,不可能是真的。因为他转手就拿现货卖了。

很多的生意不赚钱,是因为他显的时间太多了,就跟饭馆一样,你要二十四小时丢人都能坐满车,你的率也保证的很高,很高很高。

很多生意不赚钱,是因为闲置的时间太多了,就跟饭馆一样,你要是二十四小时都能坐满,你的利润率也能保证很高很高。

其实就两头就是两头,你就不能站中间,你站中间就两边不靠,要比牛逼要便宜。

其实就是两头,你不能站中间,站中间就两边不靠,要比牛逼又要便宜。

将来如果你这个内容或者你这个网站的接口对agent不友好,你就会被从这个游戏规则里干掉。

将来如果你的内容或者网站的接口对 agent 不友好,你就会被从这个游戏规则里干掉。

所有的产品逻辑,你的工程逻辑都会因为ai就抹平了。

所有的产品逻辑、工程逻辑都会因为 AI 被抹平。

数字与实体

B300 八卡服务器国内现货价一千四百多万人民币6:01
同配置服务器美国售价五十多万美金(约合人民币六七百万)6:01
OpenAI 租算力金额四百五十亿美元4:59
阿里融资金额八百亿港币10:10
五百一十二台机器报价七十多亿10:10
大模型厂商毛利率百分之六七十19:21
互联网流量中 AI 占比百分之七十39:14
英伟达单日涨幅百分之六点几24:44

术语

CUDA统一计算设备架构
英伟达的软件中间层,连接编程与 GPU,是其护城河核心。
KYC了解你的客户
出口管制下的身份核验,需证明非中国买家且有 IDC 位置。
信用证信用证
银行担保的纸质版支付宝,用于大宗贸易,需配第三方仓库和仓单。
SSR服务端渲染
后端把内容渲染进 HTML 一次性返回,便于 AI 端侧抓取。
GEO生成引擎优化
面向 AI 生成引擎的内容优化,替代传统 SEO 关键词策略。
MCP模型上下文协议
把数据服务封装成协议供 AI 调用的方案。

收听指南

谁该听

关注算力供应链、GPU 黑市、企业 AI 落地和产品设计逻辑的创业者与工程师。

可跳过

中间模型评测与盲测部分(27:00-31:00)可快进。