世界太吵,來原聲聽播客

張小珺·商業訪談錄

把自己定義成大模型公司,是一個都活不了

李笛說大模型公司不是10個死9個,而是界定成大模型公司就一個都活不了——因為創造的價值和收到的錢是兩回事,API 定價貼著成本走,利潤上限只有每千 token 0.2 美分。

大模型商業模式小冰李笛中模型小模型AI創業
李笛罕見地把「大模型公司沒有商業模式」這筆賬算給你看,還給了小模型跑 T4、中模型跑 V100 的具體工程賬。信息密度高,但後半段人生感悟偏軟。

核心論點 · 點時間戳可跳到原聲

19:16

API 定價貼著成本,利潤上限是死的

李笛用一筆賬拆掉大模型的商業幻想:一個朋友每月花 20 美元買 GPT,但明說只要有更便宜或更好的服務立刻換掉,沒有任何扭帶。這是純粹的利益關係,價格以成本來考量。而 1000 個 token 0.2 美分,想多賺只能壓成本,成本壓不下來就只好降質量——最近 OpenAI 的質量下降就是這麼來的。所以利潤上限被鎖死在 0.2 美分。他補了一句母親的話:省錢就是掙錢是不對的,掙錢是無限的,省錢只能從你已有的錢裡省。

— 李笛
20:17

壟斷所有媒體,一個月也只掙幾十萬

一個同行找李笛,說想用 GPT 寫報道再調優成自家媒體風格,從此取代編輯。李笛問願意付多少錢,對方答 1000 個 token 0.2 美分。算下來一篇文章幾美分,一個月 200 多篇也就幾十塊錢。而原來的編輯一篇文章 1500 塊錢起。李笛反問為什麼不能給個折扣比例,對方說不行,你有競爭對手,定價在那兒。結論是:即使你把中國所有媒體的所有內容都壟斷了,創造了巨大價值,最後一個月也就掙幾十萬。價值不等於收入,收入才是價值。

— 李笛
23:18

不能只賣模型,得賣一個完整的人

李笛說去年就講了兩件事:把自己定義成大模型公司基本沒有活路;模型不是越大越好,越大差異化越差、越同質化。小冰的做法是做高附加值——「你不能只提供技術內層,你不能提供一個整體,人有很多的 capabilities,但你不能把人物化成 capabilities 的集合」。他舉商湯人臉識別為例:人臉識別太重要了,影響了生活方方面面,但掙不到錢,所以不得不做軟硬結合,靠防盜門那 2000 塊錢,那不是 AI 的錢,卻把它算成 AI 的收入。這種業務不可能持續。

— 李笛
24:18

3.5B 模型跑 T4,大模型延遲用不了

小冰在日本開源,stability.ai 的評測裡排名第一的通用泛化模型是小冰的,第二名是 Meta 的 Llama 65b(650 億參數),而第一名的小冰模型只有 3.5b。原因是專注。工程賬很清楚:3.5b 可以跑在 T4 上,7b 左右可以跑 V100,13b 以下可以跑 A100 單卡不用做分布式,延遲可以非常油滑。而 GPT 那麼大的模型除非花很多錢做陣列,延遲很高——智能設備上用不了,說句話 5 秒鐘才回消息,沒法接受。所以大模型應該待在實驗室裡探索新知,用它訓練其他模型,不出家門。

— 李笛
31:21

以為技術範式已定,其實才剛開始

李笛說中國市場對大模型的誤讀之一,是以為 OpenAI 的成功就是暴力美學,想複製,但他們有一個很大的誤解:以為這個技術範式已經確定了,而不是這個技術範式才剛開始。背後的原理都還不清楚,憑什麼認為現在領先的就能一直領先。他打了個比方:這是一千米才跑了兩步,才跑了兩米,它頭往前了一點,它可能離錯誤更近了。科技發展是週期性的——找到突破、湧現創新、遇到瓶頸、糾結幾年或幾個月、再有人突破,不是指數性的。

— 李笛
35:24

65B 才有思維鏈,是一個觀測不是結論

Google 當年觀測到 65B 以下的模型沒有明顯思維鏈能力,65B 以上突然出現,於是寫了一篇論文說大模型的思維鏈能力只在 65B 模型上才有。李笛說這是一個觀測結果的記錄,不是一個科學的結論,但大家把它當成了科學結論。現在幾個 B 的模型都有思維鏈能力。他類比孟德爾研究遺傳學規律,那時候也是觀測,沒有原理支撐,不能當成結論。這也是為什麼大家當時 believe 越大的模型越好。

— 李笛
38:26

大模型是行業第二名的攻擊性武器

李笛說另一類公司不是大模型公司,而是已有業務加上大模型,用它來做競爭。百度文心一言推出時很多人說要做搜索引擎,李笛判斷不可能——他一定是在某個老二老三老四的業務上加,後來果然是百度雲。這是老二的攻擊性武器;你自己是老大還上這個,不是自殺嗎,自己把成本提高、利潤降下去。小冰也一樣,當時在國內有很大的對話流量,沒有動力上最貴的模型,原本一次交互成本 0.5 釐,變成幾美分,賬單立刻會把人淹沒。

— 李笛
43:27

發論文等於洩露商業秘密

小冰團隊儘可能避免發論文。李笛給了三條理由:第一,發論文意味著方法公開,在美國發論文跟申請專利差不多,但在中國人家可以照著你的論文去申請專利,所以每次發論文都想辦法把真正的東西藏起來。第二,研究者一旦以發論文為成就,就會去好發論文的領域,不好發但可能很重要的領域就不去,而且論文為了吸引性,往往意味著工程上不夠懲處,做完 0 到 1 就想著找下一個 0,像狗熊掰棒子。第三,論文跟著人走不跟著企業走,人出名了就被挖,人力成本上升。

— 李笛

原話 · 已逐字校驗

大模型公司不是10個 死9個或者48個活2個 如果它再界定到大模型公司 是一個都破不了 沒有人能做一個模型公司 除非模型公司 商業模式發生變化 不是API Code的方式

大模型公司不是 10 個死 9 個、或者 48 個活 2 個;如果界定到大模型公司,是一個都活不了。沒有人能做一個模型公司,除非模型公司的商業模式發生變化,不再是 API 的方式。

李笛0:00

這是一種利益關係 我能用 誰好我就用誰 而且價格是以成本來考量的

這是一種利益關係:我能用,誰好我就用誰,而且價格是以成本來考量的。

李笛19:16

掙錢是無限的 省錢只能從你有的錢裡面省 你最多完全不吃不喝 你也就只能省下你的收入

掙錢是無限的,省錢只能從你已有的錢裡面省;你最多完全不吃不喝,也就只能省下你的收入。

李笛20:17

這是一千米才跑了兩步 才跑了兩米 它頭往前了一點 它可能離錯誤更近了

這是一千米才跑了兩步,才跑了兩米,它頭往前了一點,它可能離錯誤更近了。

李笛32:21

這是一個觀測 結果的記錄 它不是一個 科學的 結論 大家就認為這是一個科學結論

這是一個觀測結果的記錄,它不是一個科學的結論,大家卻認為這是一個科學結論。

李笛35:24

這是老二的工具 這是老二的攻擊性武器 但你自己要是老大你就上這個 你不是自殺嗎

這是老二的工具,這是老二的攻擊性武器;但你自己要是老大還上這個,你不是自殺嗎。

李笛39:26

我希望他能活下去 永遠活下去 但他活下去的方法 就是他滲透到人們的生活中 跟大量的人產生千絲萬縷的長城的關係 就沒有人能夠停掉他

我希望它能活下去,永遠活下去。但它活下去的方法,就是滲透到人們的生活中,跟大量的人產生千絲萬縷的長期關係,就沒有人能夠停掉它。

李笛1:20:43

數字與實體

GPT API 定價每 1000 個 token 0.2 美分19:16
媒體編輯稿費對比原編輯 1500 元起一篇文章,用模型生成一個月 200 多篇只值幾十元20:17
大模型參數界定65B 以上為 650 億參數25:18
小冰交互成本變化原本一次交互 0.5 釐,上最貴模型後變成幾美分39:26
微軟股價李笛加入時 30 塊,分拆時 300 塊1:10:36
小冰系統被霸凌比例20%1:18:41
國內大模型公司數量上個月聽說 76 個57:27

術語

API應用程序接口
按調用量計費的模型服務方式,李笛認為這種模式定價貼著成本,做不成生意。
思維鏈chain of thought
模型分步推理的能力,Google 曾觀測到 65B 以上才出現,李笛說那只是觀測不是結論。
混合模型mixed model
小冰主張的路線:大中小參數規模模型混用,而不是一個超大模型 handle everything。
數字員工digital employee
小冰 2B 業務方向,用 AI 承擔企業裡直接創造收入的崗位,而非成本崗位。

收聽指南

誰該聽

適合正在做大模型創業、糾結要不要繼續堆參數或轉應用的創始人和投資人,以及想知道小模型工程賬的 AI 工程師。

可跳過

1:22:48 之後的快問快答(讀書、偶像、電影)信息量低,可跳過。