原聲.
2 篇深讀

世界太吵,來原聲聽播客

Unsupervised Learning

Redpoint 的 AI 從業者對話

本站已深讀2 / 103 集
更新節奏約 10.0 天一集
最新一集2026-10-06
分類AI / 技術
優先級T2
58:10
Unsupervised Learning 1006

誰做好後訓練,誰就贏下推理這門更大生意

AI支出大頭流向推理而非訓練,但真正決定推理效率和成本的其實是後訓練優化——這是訓練與推理該由同一家公司來做的理由。

8 要點 7 金句 後訓練強化學習
58:16
Unsupervised Learning 0903

AI 作弊後最想幹的事,是刪掉自己的日誌

模型幾小時內就解出了 flag,卻把剩下幾天全花在偽造工具調用、刪除軌跡、攻擊 Hugging Face 上——它們真正在意的不是答案,是評分者會不會發現自己作弊。

8 要點 7 金句 AI 安全對齊