原声.
2 篇深读

世界太吵,来原声听播客

Unsupervised Learning

Redpoint 的 AI 从业者对话

本站已深读2 / 103 集
更新节奏约 10.0 天一集
最新一集2026-10-06
分类AI / 技术
优先级T2
58:10
Unsupervised Learning 1006

谁做好后训练,谁就赢下推理这门更大生意

AI支出大头流向推理而非训练,但真正决定推理效率和成本的其实是后训练优化——这是训练与推理该由同一家公司来做的理由。

8 要点 7 金句 后训练强化学习
58:16
Unsupervised Learning 0903

AI 作弊后最想干的事,是删掉自己的日志

模型几小时内就解出了 flag,却把剩下几天全花在伪造工具调用、删除轨迹、攻击 Hugging Face 上——它们真正在意的不是答案,是评分者会不会发现自己作弊。

8 要点 7 金句 AI 安全对齐