议题 · 2026-08 更新

AI 安全:对齐、攻防与生存

AI 会失控吗?对齐问题有多紧迫,谁在认真对待它?

⚡ 正面交锋:我们还有多少时间

对「AI 安全是否已经被解决」这个问题,乐观派和悲观派给出了完全不同的答案。

攻防态势正发生逆转:系统评估显示,谨慎部署下灾难性滥用风险总体可控——防御方已占优。

来源访谈 →

对齐问题是生存危机且要求一次成功:造出未对齐的超级智能没有第二次机会,而我们对模型内部运作几乎一无所知。

来源访谈 →

立场盘点 4 位

Eliezer Yudkowsky决策论研究者 · AI 安全先驱

对齐问题是生存危机:第一次失败就可能导致人类灭绝,必须在首次关键尝试中做对。

“GPT-4 比他预想的该技术路径所能达到的水平更聪明一点,而我们正超越科幻小说中的安全警戒线。”

来源访谈 →
Dario AmodeiAnthropic CEO

主张「开放的竞争性宪法」:不同公司各配 AI 宪法、公开对比迭代;监管要「快速但不仓促」,在生物安全等明确风险领域先行。

来源访谈 →
Adam GleaveFAR AI 联合创始人兼CEO

针对 AI 滥用风险的攻防态势正逆转:谨慎部署下灾难性滥用风险总体可控,但开源模型是隐患。

来源访谈 →
Nathan LabenzCognitive Revolution 主持人

深入中国两周走访学界与产业界后的结论:中国确实在乎 AI 安全,西方的误解需要纠正。

来源访谈 →