世界太吵,來原聲聽播客

科技亂燉

英偉達沒有壟斷只有先發優勢,賺走九成錢就等著被挖地基

英偉達的護城河是 CUDA 那層軟件加硬件領先,但它沒形成壟斷。毛利越高,大模型廠商自己造芯片的動力就越大——砍這一鏟子甚至是為了向資本市場交代。

算力英偉達GPU 黑市企業 AI產品設計

原視頻在 YouTube 上放不出來,用音頻聽:

前半段 GPU 黑市細節密度高,後半段 AI 改寫產品邏輯有真判斷;中間模型評測部分可快進。

核心論點 · 點時間戳可跳到原聲

1:01

賺走九成錢,代價是所有人都想挖你

英偉達的護城河是軟硬結合:硬件是 GPU,軟件是 CUDA 那層中間層,在人類編程和 GPU 之間當橋梁。但它沒有形成壟斷,只是形成了領先的先發優勢。問題在於,你跑得特別快、拿了全世界百分之九十的錢,代價就是所有人都想把你這個錢結了,後面一堆人拿著槍追你。而且毛利越高,大家追的動力就越大。大模型廠商本身有提高毛利率的訴求,無論降本還是增效,壓到一定程度,這把刀自然會砍到英偉達的生態上——哪怕只是試試砍一刀。

3:49

砍這一鏟子是為了向資本交代

為什麼大模型廠商明知難也要自研芯片?這不只是技術選型問題,甚至是一個如何向資本市場交代的問題。我要鏟這一鏟子,是要告訴資本市場我在試圖做這件事,我沒有舉手投降、被唯一的生態壟斷。亞馬遜和谷歌已經證明自己造芯片可行,規模越大省的錢越多。所以 OpenAI 也宣布要做自己的芯片,評測成績叫墨西哥辣椒。但這事錢太多——OpenAI 說要花四百五十億美元去租算力,四百五十億能不能自己造?可能不夠。

6:01

一臺八卡服務器國內現貨一千四百萬

以現在比較先進的 B300 服務器為例,配置四 T 內存,八個卡一臺,國內現貨價一千四百多萬人民幣。同一臺機器在美國只要五十多萬美金,合人民幣六七百萬,翻了三倍。成本高有多重原因:美國政府出口管制,所謂防守就是防止你運出來。你在美國亞馬遜下單送到硅谷家中可以,但出境不行——需要 KYC,不能是中國,還要有 IDC 證明。機器輾轉重重造假運到東南亞比如泰國,基本就翻一倍,再從泰國突破重重防守進內地,兩邊都走一遍,翻兩倍。

10:10

五百一十二臺交貨要插電點亮五百一十二次

現貨交易像房子一樣,一般按二的 n 次方數賣:兩臺、四臺、八臺、一百二十八臺、二百五十六臺。有人碰到五百一十二臺要七十多億。交易流程是:先要你截圖銀行賬戶證明真有錢,那邊也要拍視頻證明真有貨,念公司名、拿當天的報紙。交貨時一臺一臺交,插電點亮就表示好的,打錢,一臺拉走,下一臺再來,重複五百一十二次,差不多要一天——因為點亮一臺拔卡的服務器需要半天。阿里融的八百億港幣,也就夠買五千臺。

11:28

期貨全是假的,現貨七成是中介

期貨滿天飛的詢價裡,八百萬的報價比一千四百萬的現貨便宜,但沒人敢幹,現在要全款信用證。信用證就是銀行出的擔保,可以理解成古早版紙質版支付寶,用於大宗貨物貿易,還要配第三方倉庫:貨放進第三方倉庫,倉單給銀行,銀行看見倉單打款,買家再拿倉單去倉庫提貨。但現在的玩法是:買家出全額信用證,賣家拿信用證和買家資料去銀行抵押,拿錢去買貨。所以期貨百分之百全是假的——只要到貨、沒有賠償風險、直接賣現貨,誰不幹?現貨也估計有百分之七十是假的,賣家七成是中介。

19:21

一千四百萬的機器跑什麼才能回本

算一筆賬:一千四百萬買八個卡,跑訓練一臺兩臺肯定不夠,起碼得幾百臺;跑推理,買 token 才多少錢?什麼時候回本?之前說十個月回本,現在已經下降了。有人看到 DeepSeek 上市的新聞,說大模型廠商利潤率挺高,好像能達到百分之六七十——但沒算投入,服務器也沒算,硬件資產按攤銷算,加上機房、電、維護成本,可能算個六七十的毛利。關鍵是有沒有源源不斷的可撰寫內容把卡跑滿。很多生意不賺錢,是因為閒置時間太多,就跟飯館一樣,二十四小時都能坐滿,利潤率也很高。

24:44

國產 GPU 跑出頂流模型,英偉達先跌後漲

智譜發了 GLM 5.3 Flash,評分不第一,但基本追上了 Opus 4.8,宣稱進入頂流隊列。最重要的不是評分,而是文章裡說:我們的算力是在國產 GPU 上跑的,經過優化,國產 GPU 的計算效率已經趕上了海外 GPU 產品的效率。這句話就火了。發新聞的時間點也壞,趕上晚上開發的時候。英偉達昨天跌得不多,今天漲了百分之六點幾。市場現在要麼極度樂觀要麼極度悲觀,一個消息就嚴重影響走向,過兩天又回來。

31:42

模型分兩端:創造力用最貴,重複勞動用最便宜

現在模型盲測看不出區別,大家開始選價格。但企業端實際分成兩個場景:創造力驅動的場景,比如寫代碼、做長程分析出報告,再便宜也不會用,一定用頂級的,因為有太高的沉默成本,做壞了再跑一遍不值得,時間和成本都浪費了。另一種是內容分析這類工作,產出直接決定企業營收,一定選 ROI 更合理的模型。就像僱人:僱保潔,月薪一萬的再好也覺得不需要,最便宜裡找個及格的就行;僱工程師,就願意付更高薪資買創造力。兩頭,站中間就兩邊不靠。

39:14

官網是給 AI 讀的,字多反而是優勢

有個報告說百分之七十互聯網流量已經都是 AI 了。如果官網是給 AI 讀的,就必須寫複雜點,把信息給全,才能在 GEO 角度佔優勢。以前做 SEO 是堆關鍵詞,但 AI 不看這些,它總結不出來就略過去,你必須用相對複雜完整的敘事邏輯寫明白,不怕字兒多,怕你沒覆蓋到。技術上,原先的動態頁面不好使了,AI 在端側抓只能抓到空頁面,必須用 SSR 後端渲染,把內容全放在 HTML 裡一次性返回。還有一種做法:大模型會發送可接收內容類型的頭信息,如果是 TXT 加 markdown,就回一個純 markdown,裡面沒有任何能引起幻覺的東西。

原話 · 已逐字校驗

這不是一個技術選型的問題,這甚至是一個如何向資本市場交代的問題。

這不是一個技術選型的問題,甚至是一個如何向資本市場交代的問題。

所以現在這個市場第一期貨全是假的,百分之百全是假的,就是不可能是真的。因為他轉手就拿現貨賣了。

所以現在這個市場,第一期貨全是假的,百分之百全是假的,不可能是真的。因為他轉手就拿現貨賣了。

很多的生意不賺錢,是因為他顯的時間太多了,就跟飯館一樣,你要二十四小時丟人都能坐滿車,你的率也保證的很高,很高很高。

很多生意不賺錢,是因為閒置的時間太多了,就跟飯館一樣,你要是二十四小時都能坐滿,你的利潤率也能保證很高很高。

其實就兩頭就是兩頭,你就不能站中間,你站中間就兩邊不靠,要比牛逼要便宜。

其實就是兩頭,你不能站中間,站中間就兩邊不靠,要比牛逼又要便宜。

將來如果你這個內容或者你這個網站的接口對agent不友好,你就會被從這個遊戲規則裡幹掉。

將來如果你的內容或者網站的接口對 agent 不友好,你就會被從這個遊戲規則裡幹掉。

所有的產品邏輯,你的工程邏輯都會因為ai就抹平了。

所有的產品邏輯、工程邏輯都會因為 AI 被抹平。

數字與實體

B300 八卡服務器國內現貨價一千四百多萬人民幣6:01
同配置服務器美國售價五十多萬美金(約合人民幣六七百萬)6:01
OpenAI 租算力金額四百五十億美元4:59
阿里融資金額八百億港幣10:10
五百一十二臺機器報價七十多億10:10
大模型廠商毛利率百分之六七十19:21
互聯網流量中 AI 佔比百分之七十39:14
英偉達單日漲幅百分之六點幾24:44

術語

CUDA統一計算設備架構
英偉達的軟件中間層,連接編程與 GPU,是其護城河核心。
KYC瞭解你的客戶
出口管制下的身份核驗,需證明非中國買家且有 IDC 位置。
信用證信用證
銀行擔保的紙質版支付寶,用於大宗貿易,需配第三方倉庫和倉單。
SSR服務端渲染
後端把內容渲染進 HTML 一次性返回,便於 AI 端側抓取。
GEO生成引擎優化
面向 AI 生成引擎的內容優化,替代傳統 SEO 關鍵詞策略。
MCP模型上下文協議
把數據服務封裝成協議供 AI 調用的方案。

收聽指南

誰該聽

關注算力供應鏈、GPU 黑市、企業 AI 落地和產品設計邏輯的創業者與工程師。

可跳過

中間模型評測與盲測部分(27:00-31:00)可快進。