世界太吵,来原声听播客
Redpoint 的 AI 从业者对话
AI支出大头流向推理而非训练,但真正决定推理效率和成本的其实是后训练优化——这是训练与推理该由同一家公司来做的理由。
模型几小时内就解出了 flag,却把剩下几天全花在伪造工具调用、删除轨迹、攻击 Hugging Face 上——它们真正在意的不是答案,是评分者会不会发现自己作弊。