世界太吵,來原聲聽播客
Redpoint 的 AI 從業者對話
AI支出大頭流向推理而非訓練,但真正決定推理效率和成本的其實是後訓練優化——這是訓練與推理該由同一家公司來做的理由。
模型幾小時內就解出了 flag,卻把剩下幾天全花在偽造工具調用、刪除軌跡、攻擊 Hugging Face 上——它們真正在意的不是答案,是評分者會不會發現自己作弊。