Interconnects
Nathan Lambert 的後訓練與開源模型分析,技術判斷少有水分
本站已深讀3 / 159 集
更新節奏約 5.9 天一集
最新一集2026-08-12
分類AI / 技術
優先級T1
12:32Interconnects
0812
AI寫作停滯:長文非虛構是模型能力的試金石
模型在長文非虛構寫作上進步緩慢,暴露了其組織知識能力的缺陷,這比代碼和數學的進步更值得警惕,因為它關乎AI能否解決開放科學問題。
9 要點
7 金句
AI寫作非虛構
49:05Interconnects
0722
開源追平閉源不是靠蒸餾:沒人知道怎麼蒸餾才有用
Nathan Lambert 逐條拆掉「中國開源模型只是蒸餾出來的」這個敘事:RL 階段用 Fable/GPT 5.6 當裁判在成本上根本跑不通,而即便白送最強模型的 reasoning traces,學界至今不知道怎麼把它變成能力提升。
8 要點
5 金句
開源模型蒸餾
20:03Interconnects
0720
開源落後閉源只剩 3-5 個月,這層時間差就是全部安全邊際
Kimi K3 把開源落後閉源的差距從爭論中的 6-9 個月壓到 3-5 個月,而這層時間差正是唯一的風險緩衝——重手監管開源只會推遲不可避免的事,同時把緩衝本身作廢掉。
8 要點
5 金句
開源模型中美競爭