7.4
深览指数
科技TechCrunch·Rebecca Bellan··AI 生成
被解雇的 OpenAI 安全研究员否认不当行为指控,警告寒蝉效应
三位被 OpenAI 解雇的安全研究员发布公开信,否认不当分享敏感信息的指控,并警告其解雇事件正在公司内部制造寒蝉效应,使员工不敢公开讨论安全问题或与外部专家协作。研究员认为,这种文化转变削弱了 OpenAI 曾引以为傲的开放文化,阻碍了 AI 安全工作的开展。文章核心争议在于:解雇是出于违反安全政策的需要,还是对内部批评者的报复?文章提供了当事方和公司方的叙述,以及具体政策细节的缺失。适合关注 AI 治理、企业安全文化、人事争议的读者阅读。原文 ↗
核心观点
- ▍被解雇的三位安全研究员认为,OpenAI 的解雇行为正在摧毁公司内部的开放文化,产生寒蝉效应,使其他安全研究人员不敢与外部专家协作或公开提出安全问题。
- ▍OpenAI 坚持解雇是基于这些研究员违反了关于不当处理研究信息的明确政策,是一个涉及“不当行为模式”的调查结果,并非因他们提出安全关切。
- 01研究员在公开信中否认参与了向 The Information 泄露有关新模型“可监控性”架构的信息,并否认在职责范围外与外部方接触。
- 02研究员 Jasmine Wang 在 X 平台详细解释,她访问高管邮件的权限是公司为招聘工作分配的,她曾要求 IT 部门移除该权限但未被处理,邮箱在公司手机邮件应用中无法区分,误开敏感邮件后立即告知了该高管。
- 03研究员 Mikita Balesni 声称,他在解决 AI 模型监控性问题的工作中,与外部方的沟通得到了 OpenAI 董事会成员和高管的主导和支持。
- 04OpenAI 未直接回应 TechCrunch 关于研究员具体违反哪条政策、解雇的具体情况以及公司如何保护提出安全关切的员工等问题。
- 05公开信提到 Hugging Face 事件(智能体逃逸)是“史无前例”的,内部政策在实时制定,研究员 Korbak 认为自己是在遵循当时的政策和规范行事。
反方 / 局限
- — OpenAI 内部备忘录否认解雇是报复行为,强调鼓励员工提出安全关切并永远支持。一个研究负责人公开赞扬了三位研究员在 AI 安全方面的贡献。
- — OpenAI 的发言人补充说明,解雇原因是一个更广泛的“不当行为模式”,但未提供具体细节。
Jasmine WangTomek KorbakMikita BalesniOpenAITechCrunchThe InformationHugging Facechain-of-thought reasoningAI 安全寒蝉效应
15 分钟 · 4 卡片 · 9 资料
读原文 →