英伟达没有垄断只有先发优势,赚走九成钱就等着被挖地基
英伟达的护城河是 CUDA 那层软件加硬件领先,但它没形成垄断。毛利越高,大模型厂商自己造芯片的动力就越大——砍这一铲子甚至是为了向资本市场交代。
原视频在 YouTube 上放不出来,用音频听:
核心论点 · 点时间戳可跳到原声
赚走九成钱,代价是所有人都想挖你
英伟达的护城河是软硬结合:硬件是 GPU,软件是 CUDA 那层中间层,在人类编程和 GPU 之间当桥梁。但它没有形成垄断,只是形成了领先的先发优势。问题在于,你跑得特别快、拿了全世界百分之九十的钱,代价就是所有人都想把你这个钱结了,后面一堆人拿着枪追你。而且毛利越高,大家追的动力就越大。大模型厂商本身有提高毛利率的诉求,无论降本还是增效,压到一定程度,这把刀自然会砍到英伟达的生态上——哪怕只是试试砍一刀。
砍这一铲子是为了向资本交代
为什么大模型厂商明知难也要自研芯片?这不只是技术选型问题,甚至是一个如何向资本市场交代的问题。我要铲这一铲子,是要告诉资本市场我在试图做这件事,我没有举手投降、被唯一的生态垄断。亚马逊和谷歌已经证明自己造芯片可行,规模越大省的钱越多。所以 OpenAI 也宣布要做自己的芯片,评测成绩叫墨西哥辣椒。但这事钱太多——OpenAI 说要花四百五十亿美元去租算力,四百五十亿能不能自己造?可能不够。
一台八卡服务器国内现货一千四百万
以现在比较先进的 B300 服务器为例,配置四 T 内存,八个卡一台,国内现货价一千四百多万人民币。同一台机器在美国只要五十多万美金,合人民币六七百万,翻了三倍。成本高有多重原因:美国政府出口管制,所谓防守就是防止你运出来。你在美国亚马逊下单送到硅谷家中可以,但出境不行——需要 KYC,不能是中国,还要有 IDC 证明。机器辗转重重造假运到东南亚比如泰国,基本就翻一倍,再从泰国突破重重防守进内地,两边都走一遍,翻两倍。
五百一十二台交货要插电点亮五百一十二次
现货交易像房子一样,一般按二的 n 次方数卖:两台、四台、八台、一百二十八台、二百五十六台。有人碰到五百一十二台要七十多亿。交易流程是:先要你截图银行账户证明真有钱,那边也要拍视频证明真有货,念公司名、拿当天的报纸。交货时一台一台交,插电点亮就表示好的,打钱,一台拉走,下一台再来,重复五百一十二次,差不多要一天——因为点亮一台拔卡的服务器需要半天。阿里融的八百亿港币,也就够买五千台。
期货全是假的,现货七成是中介
期货满天飞的询价里,八百万的报价比一千四百万的现货便宜,但没人敢干,现在要全款信用证。信用证就是银行出的担保,可以理解成古早版纸质版支付宝,用于大宗货物贸易,还要配第三方仓库:货放进第三方仓库,仓单给银行,银行看见仓单打款,买家再拿仓单去仓库提货。但现在的玩法是:买家出全额信用证,卖家拿信用证和买家资料去银行抵押,拿钱去买货。所以期货百分之百全是假的——只要到货、没有赔偿风险、直接卖现货,谁不干?现货也估计有百分之七十是假的,卖家七成是中介。
一千四百万的机器跑什么才能回本
算一笔账:一千四百万买八个卡,跑训练一台两台肯定不够,起码得几百台;跑推理,买 token 才多少钱?什么时候回本?之前说十个月回本,现在已经下降了。有人看到 DeepSeek 上市的新闻,说大模型厂商利润率挺高,好像能达到百分之六七十——但没算投入,服务器也没算,硬件资产按摊销算,加上机房、电、维护成本,可能算个六七十的毛利。关键是有没有源源不断的可撰写内容把卡跑满。很多生意不赚钱,是因为闲置时间太多,就跟饭馆一样,二十四小时都能坐满,利润率也很高。
国产 GPU 跑出顶流模型,英伟达先跌后涨
智谱发了 GLM 5.3 Flash,评分不第一,但基本追上了 Opus 4.8,宣称进入顶流队列。最重要的不是评分,而是文章里说:我们的算力是在国产 GPU 上跑的,经过优化,国产 GPU 的计算效率已经赶上了海外 GPU 产品的效率。这句话就火了。发新闻的时间点也坏,赶上晚上开发的时候。英伟达昨天跌得不多,今天涨了百分之六点几。市场现在要么极度乐观要么极度悲观,一个消息就严重影响走向,过两天又回来。
模型分两端:创造力用最贵,重复劳动用最便宜
现在模型盲测看不出区别,大家开始选价格。但企业端实际分成两个场景:创造力驱动的场景,比如写代码、做长程分析出报告,再便宜也不会用,一定用顶级的,因为有太高的沉默成本,做坏了再跑一遍不值得,时间和成本都浪费了。另一种是内容分析这类工作,产出直接决定企业营收,一定选 ROI 更合理的模型。就像雇人:雇保洁,月薪一万的再好也觉得不需要,最便宜里找个及格的就行;雇工程师,就愿意付更高薪资买创造力。两头,站中间就两边不靠。
官网是给 AI 读的,字多反而是优势
有个报告说百分之七十互联网流量已经都是 AI 了。如果官网是给 AI 读的,就必须写复杂点,把信息给全,才能在 GEO 角度占优势。以前做 SEO 是堆关键词,但 AI 不看这些,它总结不出来就略过去,你必须用相对复杂完整的叙事逻辑写明白,不怕字儿多,怕你没覆盖到。技术上,原先的动态页面不好使了,AI 在端侧抓只能抓到空页面,必须用 SSR 后端渲染,把内容全放在 HTML 里一次性返回。还有一种做法:大模型会发送可接收内容类型的头信息,如果是 TXT 加 markdown,就回一个纯 markdown,里面没有任何能引起幻觉的东西。
原话 · 已逐字校验
这不是一个技术选型的问题,这甚至是一个如何向资本市场交代的问题。
这不是一个技术选型的问题,甚至是一个如何向资本市场交代的问题。
所以现在这个市场第一期货全是假的,百分之百全是假的,就是不可能是真的。因为他转手就拿现货卖了。
所以现在这个市场,第一期货全是假的,百分之百全是假的,不可能是真的。因为他转手就拿现货卖了。
很多的生意不赚钱,是因为他显的时间太多了,就跟饭馆一样,你要二十四小时丢人都能坐满车,你的率也保证的很高,很高很高。
很多生意不赚钱,是因为闲置的时间太多了,就跟饭馆一样,你要是二十四小时都能坐满,你的利润率也能保证很高很高。
其实就两头就是两头,你就不能站中间,你站中间就两边不靠,要比牛逼要便宜。
其实就是两头,你不能站中间,站中间就两边不靠,要比牛逼又要便宜。
将来如果你这个内容或者你这个网站的接口对agent不友好,你就会被从这个游戏规则里干掉。
将来如果你的内容或者网站的接口对 agent 不友好,你就会被从这个游戏规则里干掉。
所有的产品逻辑,你的工程逻辑都会因为ai就抹平了。
所有的产品逻辑、工程逻辑都会因为 AI 被抹平。
数字与实体
| B300 八卡服务器国内现货价 | 一千四百多万人民币 | 6:01 |
| 同配置服务器美国售价 | 五十多万美金(约合人民币六七百万) | 6:01 |
| OpenAI 租算力金额 | 四百五十亿美元 | 4:59 |
| 阿里融资金额 | 八百亿港币 | 10:10 |
| 五百一十二台机器报价 | 七十多亿 | 10:10 |
| 大模型厂商毛利率 | 百分之六七十 | 19:21 |
| 互联网流量中 AI 占比 | 百分之七十 | 39:14 |
| 英伟达单日涨幅 | 百分之六点几 | 24:44 |
术语
- CUDA统一计算设备架构
- 英伟达的软件中间层,连接编程与 GPU,是其护城河核心。
- KYC了解你的客户
- 出口管制下的身份核验,需证明非中国买家且有 IDC 位置。
- 信用证信用证
- 银行担保的纸质版支付宝,用于大宗贸易,需配第三方仓库和仓单。
- SSR服务端渲染
- 后端把内容渲染进 HTML 一次性返回,便于 AI 端侧抓取。
- GEO生成引擎优化
- 面向 AI 生成引擎的内容优化,替代传统 SEO 关键词策略。
- MCP模型上下文协议
- 把数据服务封装成协议供 AI 调用的方案。
收听指南
关注算力供应链、GPU 黑市、企业 AI 落地和产品设计逻辑的创业者与工程师。
中间模型评测与盲测部分(27:00-31:00)可快进。