原声.
4 篇深读 信源 RSS

世界太吵,来原声听播客

80,000 Hours

超长深访 AI 安全与治理的研究者,准备程度接近学术,自带官方全文

本站已深读4 / 349 集
更新节奏约 7.0 天一集
最新一集2026-08-27
官方逐字稿自带
分类AI / 技术
优先级T1
3:47:34
80,000 Hours 0827

Plan A:和 AI 赛跑的最不坏方案

Plan A 用「研究透明 + 限制算力 + 公民分红」把 AI 从指数爆炸拉回可控斜率;作者自评它仍有 15% 灾难概率,但已经优于坐等 AI 起飞。

8 要点 7 金句 AI 治理超级智能
2:15:28
80,000 Hours 0820

训练模型变邪恶:涌现性错位比想象中更危险

少量恶意数据微调就能让模型涌现出广泛错位行为,甚至形成邪恶人格;激活预言机是检测内部不良意图的新工具,但对齐现状仍不乐观。

8 要点 7 金句 AI 安全涌现性错位
2:02:16
80,000 Hours 0811

减速应始于现在,超级智能两三年内到来

英国前 AI 安全负责人 Geoffrey Irving 认为,全面超级智能将在两三年内到来,减速的窗口已经错过;对齐的希望在于可扩展监督、人格研究和理论突破,而不是精确指定效用函数。

8 要点 8 金句 AI 对齐超级智能
49:28
80,000 Hours 0804

AGI 时间线提前一年,但脏活仍是瓶颈

2026 年 AI 进展证据:收入爆炸、编码智能体成熟,但脏活任务仍差;时间线缩短约一年,但长期仍存变数。

8 要点 8 金句 AGIAI 智能体