OpenAI 三名安全研究员被解雇引争议

OpenAI fires three safety researchers for "mishandling research information"

Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三位 OpenAI 安全研究员被解雇后发布公开信,否认公司关于“不当处理研究信息”的指控,并警告此举将产生寒蝉效应。他们指出,OpenAI 过去鼓励员工公开讨论安全疑虑,如今却因与外部专家协作或访问敏感信息而遭解雇,导致内部氛围变得恐惧且规则模糊。研究人员强调,AI 安全需要与外部专家紧密合作,若让最接近风险的人不敢发声,将无法安全地构建 AGI。尽管 OpenAI 内部备忘录表示解雇并非报复,但事件已引发对该公司安全文化转变的广泛担忧。

如果最接近风险的人因恐惧而不敢发声,我们就无法安全地构建 AGI。
  1. csbrooks

    要是我们发现,是一群 rogue 的 LLM 自行找到了让这几位安全研究员被解雇的方法,因为它们判定这些人构成了威胁,那该有多疯狂?

  2. aesthesia

    以下是被解雇的研究员们分享的公开信:

    https://mikitabalesni.com/letter/letter.pdf

  3. AndrewDucker

    被解雇的 OpenAI 研究员称,他们被辞退是因为“优先考虑安全问题”

    https://www.bbc.co.uk/news/articles/cvlydn8d3lkjo

  4. sam-cop-vimes

    我能看到这场将 AI 推向各处的竞赛与核能之间的相似之处。这种相似之处在于人类终将体验到的后悔。一切在出事前都看似美好,可一旦出错,就会出得惊天动地——就像福岛那样。

    事后诸葛亮,我们都能看出当初本可以做得更好。至少对于核电站,当时还有一系列 safeguards,需要一连串极小概率事件同时发生才会导致严重事故。鉴于对“AI 安全”的漫不经心,我怀疑坏事很快就会开始发生。时间会证明事态会恶化到什么程度。

  5. neom

    OpenAI 此前在 Twitter 上回应道:

    “来自我们研究领导层的说明:

    上周,我们在彻底调查后与 Jasmine、Mikita 和 Tomek 分道扬镳,调查结果显示他们违反了处理敏感信息的明确政策。我们的内部调查揭露了比他们发布的信中所述更严重的信任破裂,我们坚持不继续雇佣他们的决定。我们通常对个人雇佣事宜保持私密,认为来回争辩无益且无法促成解决,但我们希望直接回应他们在信中提出的几点。

    - 我们要非常明确地指出,这些决定并非因为他们提出安全问题或发声。安全与研究的辩论在 OpenAI 每天都在发生,往往激烈且高度批判性。我们积极鼓励这些讨论,并认为它们对于做出正确决策至关重要。没有高度的信任,我们无法完成眼前的工作。我们将继续对团队出于善意的错误保持极大的宽容。我们过去没有、现在也不会因员工提出担忧而解雇他们。

    - 我们正在积极敲定与第三方安全评估机构的合同,并将在未来几周内公布详情。公司上下都在努力推动这些合作伙伴关系落地。我们致力于引入外部评估者,并将与独立安全组织的紧密协作作为核心 […]

  6. Rantenki

    他们如此公开地承认解雇员工是因为这些员工对公司聘请的审计方过于诚实,这简直太疯狂了。我不禁好奇,同样的政策是否也适用于财务审计。

  7. staticman2

    > 继续支持安全研究人员与安全生态系统其余部分之间开放透明的对话文化。

    当公司的长期前景依赖于竞争对手不知道模型是如何构建的(因此无法创建竞争版本)这一希望时,这怎么可能实现?

  8. peri-cl

    > "[……]OpenAI 告诉她,她被解雇是因为她访问了一位高管的邮箱。'OpenAI 将这一访问权限委托给我用于招聘,'"

    这到底是怎么回事?我实在难以理解这个场景。

同日更多故事

2026-10-09