如果你的雇主可能会毁灭世界,你会怎么办?

📌 One-Sentence Summary
通过对 OpenAI、Anthropic 和 Google DeepMind 前研究人员的访谈,探讨了留在公司内部影响 AI 安全与离开以抗议风险增加风险之间的伦理困境。
📝 Summary
本文与八位离开主流实验室的高级 AI 研究人员进行了深度对话。文章分析了“内部博弈”(从内部进行推动)与“外部博弈”(公共倡导与研究)之间的内在冲突。核心主题包括 AGI 发展的鲁莽速度、企业自我监管的失败,以及担心自己的工作可能导致全球性灾难的员工所承受的心理负担。
💡 Main Points
“内部游戏”的失败
Daniel Kokotajlo 等研究人员发现,留下来影响安全性是无效的,因为领导层虽然听取了担忧但并未采取行动,而是倾向于过度乐观的叙事。
战略性辞职
Jacob Coxon 在看到 Anthropic 2027 年的内部计划后离开,他认为这些计划“疯狂”且鲁莽,并意识到政府监管可能是不可能的。
实验室的道德债务
尽管 Anthropic 等实验室是基于安全原则创立的,但被指控在积累权力的同时将世界推向超级智能风险的边缘,从而积累了道德债务。
失能的陷阱
许多研究人员留下来是因为在实验室内部提供了一种自主感和安全感,让他们能够避免成为无力旁观者的恐惧。
💬 Key Quotes
离开实验室就像“放弃你的国籍」。现在你成了一个无名之辈」。
我不认为可以信任公司进行自我监管。
非正式对话中提到的主要问题是,人们并不预期政府监管能及时到位。
我很大程度上归咎领导层,因为他们正直接将我们推向深渊。
📊 Article Meta
AI Screening: 90
Featured: Yes
Source: New York Magazine -- Intelligencer
Author: Clara Collier, Angela Chen
Category: 人工智能
Language: 英文
Read Time: 40 min
Word Count: 9966
Tags:
AI 与智能应用 , 美国政治 , AGI 研究与路径 , AI 安全与对齐 , AI研究前沿
路过
实话,说的不明不白