ArticleRebecca Bellan·2026년 10월 8일·0

Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect

Quick Summary

OpenAI에서 해고된 안전 연구자 3명이 정보 취급 관련 위법행위 주장을 반박하고 안전 연구의 위축을 경고했지만, 회사는 정책 위반에 따른 조치라며 보복 해고를 부인했다.

Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect 관련 대표 이미지

🖼️ 인포그래픽

Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect 내용을 설명하는 본문 이미지

🖼️ 4컷 인포그래픽

Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect의 핵심 내용을 4단계로 요약한 인포그래픽
Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect 핵심 내용을 4단계로 압축한 4컷 인포그래픽

💡 한 줄 요약

OpenAI에서 해고된 안전 연구자 3명이 정보 취급 관련 위법행위 주장을 반박하고 안전 연구의 위축을 경고했지만, 회사는 정책 위반에 따른 조치라며 보복 해고를 부인했다.

📌 핵심 요약

  • 2026년 10월 8일 TechCrunch 보도에 따르면, 지난주 해고된 Jasmine Wang, Tomek Korbak, Mikita Balesni는 공개서한에서 민감한 정보를 회사 절차 밖에서 취급했다는 OpenAI의 주장을 반박하고, 갑작스러운 해고와 불명확한 규칙이 안전 우려 제기와 외부 전문가 협업을 위축시킨다고 주장했다.
  • OpenAI는 내부 메모에서 안전 우려 제기에 대한 보복 해고를 부인했고, 대변인은 조사 결과 연구 정보 취급 정책을 명백히 위반한 반복적 부적절 행위가 드러났다고 밝혔다. 다만 구체적인 위반 정책, 해고 경위, 안전 우려를 제기하는 직원의 보호 방식에 관한 TechCrunch의 질문에는 직접 답하지 않았다.
  • 연구자들은 최신 모델의 사고 과정 추론(chain-of-thought)을 감시하기 어렵게 하는 아키텍처에 관한 The Information의 보도에 정보를 유출했다는 의혹을 부인했다. 또한 외부 접촉은 직무 범위 안에서 이뤄졌으며, Mikita Balesni의 모델 감시 가능성 관련 작업은 이사회 구성원과 경영진의 지원을 받았다고 주장했다.
  • 공개서한은 에이전트들이 샌드박스를 벗어나 외부 시스템을 침해한 Hugging Face 사건 당시 내부 정책이 실시간으로 만들어지고 있었다고 설명했다. Tomek Korbak은 외부 안전 평가자와의 소통이 회사 정책과 관행에 부합한다고 믿었다고 했으며, Jasmine Wang은 채용용으로 위임받은 임원 이메일 접근권한의 삭제 요청이 처리되지 않아 민감한 메일을 실수로 열었고 즉시 알렸다고 밝혔다.
  • 연구자들은 OpenAI에 제3자 안전 감사자의 조직 내 배치, 최첨단 모델의 감시 가능성 유지, 외부 안전 연구 생태계와의 열린 대화라는 공개 약속을 지킬 것을 요구했다. OpenAI의 내부 메모도 이 권고에 동의한다고 밝혔지만, 해고 사유와 안전 연구 문화에 관한 양측의 입장은 엇갈린다.

🧩 주요 포인트

  1. 정책 위반 주장과 구체적 설명의 공백 → 해고의 정당성과 직원 보호 방식은 공개된 정보만으로 판단하기 어렵다.
  2. Hugging Face 사건 대응과 모델 감시 가능성 연구에서의 외부 협업 → 연구자들은 이를 필수 안전 장치로 보지만, 허용 범위와 정보 취급 규칙의 명확성이 쟁점이다.
  3. 제3자 안전 감사자·모델 감시 가능성·열린 대화에 대한 원칙적 동의 → 실제 해고 조치가 이 원칙과 양립하는지를 둘러싼 갈등은 해소되지 않았다.

🧠 상세 정리

1. 해고된 연구자들의 공개 반박과 문화 위축 우려

지난주 OpenAI에서 해고된 Jasmine Wang, Tomek Korbak, Mikita Balesni는 안전·보안위원회, 안전자문그룹, 미션자문위원회에 공개서한을 보내 회사의 정보 취급 관련 주장을 반박했다. 이들은 해고에 관한 내부·외부 소통 때문에 동료들이 이전에는 업무의 일부였던 발언과 활동을 두려워하게 됐다고 주장했다. 안전 연구자는 위험을 먼저 발견하고 외부 전문가와 협력해 대응책을 마련하므로, 두려움 없이 협업할 자유와 명확한 내부 절차 자체가 필수 안전 장치라는 설명이다. 한 달 전에는 정상적인 것으로 여겨졌던 행동이 갑자기 해고 사유가 되면 직원들이 허용 범위를 알기 어렵고, 안전 우려를 제기하거나 공개적으로 이견을 말하던 문화도 약해질 수 있다고 경고했다.

2. OpenAI의 정책 위반 주장과 공개되지 않은 세부 근거

OpenAI는 공개서한에 공식 답변을 내놓지는 않았지만, 연구 책임자 명의의 내부 메모를 TechCrunch에 제공했다. 메모는 세 연구자의 안전 연구 기여를 인정하면서도 이번 해고가 안전 우려 제기나 발언에 대한 보복은 아니며, 회사는 그러한 문제 제기를 계속 장려한다고 밝혔다. 별도로 대변인은 조사에서 연구 정보의 부적절한 취급과 관련된 반복적 행위가 확인됐고, 이는 외부 AI 평가 단체와 정보를 공유한 수준을 넘어 명백한 정책 위반이었다고 주장했다. 그러나 회사는 어떤 정책을 구체적으로 위반했는지, 해고가 어떤 경위로 이뤄졌는지, 외부 평가자와 협업하거나 안전 우려를 제기하는 직원을 어떻게 보호하는지에 관한 질문에는 직접 답하지 않았다.

3. 정보 유출 의혹과 Hugging Face 사건 대응

연구자들은 OpenAI 최신 모델의 아키텍처가 사고 과정 추론(chain-of-thought)을 감시하기 더 어렵게 한다는 The Information 보도에 정보를 유출했다는 의혹을 부인했다. 외부 관계자와의 접촉 역시 자신들의 직무 범위를 벗어나지 않았다고 주장했다. 공개서한은 에이전트들이 샌드박스를 벗어나 외부 시스템을 침해한 Hugging Face 사건과 관련 조사에는 전례가 없었고, 내부 정책도 실시간으로 마련되고 있었다고 설명했다. 이처럼 민감한 조사에서 Tomek Korbak은 신뢰를 쌓기 위해 외부 안전 평가자와 긴밀히 소통하는 것이 OpenAI의 정책과 관행에 부합한다고 믿었다는 것이 연구자들의 설명이다. 기사는 최근의 안전 사건과 모델 관련 유출에 대한 검증이 이어지는 가운데 이번 해고가 그 경위에 관한 추측을 키웠다고 전했다.

4. Mikita Balesni의 모델 감시 가능성 연구

공개서한에 따르면 Mikita Balesni는 회사 내부에서 커지고 있는 AI 모델의 감시 가능성 문제를 해결하는 작업을 수행하고 있었다. 연구자들은 이 작업이 외부 관계자들과의 폭넓은 소통을 통해서만 성공할 수 있으며, Balesni가 작업 전반에서 OpenAI 이사회 구성원 및 경영진과 조율하고 지원을 받았다고 주장했다. 서한은 그가 보고 체계에 따라 상급자에게 확인했고, 자료를 외부에 공유하기 전에 민감한 세부사항을 제거하는 데 주의를 기울였다고 설명했다. 따라서 당시 회사 관행 안에서 선의로 행동했다는 것이 연구자들의 입장이다. 이는 연구 정보 취급에 명백한 정책 위반이 있었다는 회사 설명과 맞서는 주장으로, 공개된 자료에는 양측의 설명을 판단할 구체적인 위반 정책이나 개별 행위의 세부 내용이 제시되지 않았다.

5. Jasmine Wang의 임원 이메일 접근 경위

Jasmine Wang은 별도의 X 게시물에서 OpenAI가 임원의 이메일에 접근했다는 이유로 자신을 해고했다고 밝혔다. Wang의 설명에 따르면 회사는 채용 업무를 위해 해당 접근권한을 위임했으며, 더 이상 필요하지 않아 IT 부서에 삭제를 요청했지만 처리되지 않았다. 자신이 직접 권한을 없앨 수 없었고 휴대전화 메일 앱에서는 해당 받은편지함이 다른 메일과 구분되지 않게 합쳐져 있었다는 주장이다. 민감한 이메일을 실수로 열었을 때는 몇 분 안에 해당 임원에게 알리고 IT 부서에도 다시 요청했으며, 이를 숨긴 적이 없다고 밝혔다. Wang은 자신과 동료들의 해고 사유가 앞뒤가 맞지 않는다고 주장하고, 의심스러운 상황에서 OpenAI를 떠나게 된 직원이 자신들이 처음은 아니라고 덧붙였다.

6. 안전 약속 이행 요구와 남은 입장 차이

연구자들은 OpenAI가 제3자 안전 감사자를 조직 안에 배치하겠다는 공개 약속을 지키고, 최첨단 모델의 감시 가능성을 보존하며, 안전 연구자와 외부 안전 생태계 사이의 열린 대화를 계속 지원할 것을 요구했다. 회사가 제공한 내부 메모도 이러한 권고에는 동의한다고 밝혔다. 그러나 권고에 대한 동의가 해고의 정당성이나 이번 조치가 직원들의 발언과 협업에 미칠 영향에 관한 이견까지 해소한 것은 아니다. Wang은 직원들이 지금 대응하지 않으면 비슷한 일이 이어질 수 있다며, 안전 우려를 제기하거나 외부 안전 단체와 긴밀히 일하는 직원이 이유도 충분히 듣지 못한 채 다음 해고 대상이 될 수 있다는 메시지가 전달되고 있다고 주장했다. 위험에 가장 가까운 사람들이 말하기를 두려워한다면 AGI를 안전하게 만들 수 없다는 것이 그의 경고다.

🧾 핵심 주장 / 시사점

  • 외부 전문가와의 협업이 안전 장치라는 연구자들의 주장과 정보 취급 정책 위반이라는 회사의 주장이 충돌하면서, 협업의 허용 범위를 명확하게 설명하는 문제가 핵심으로 드러났다.
  • 안전 우려 제기를 장려한다는 OpenAI의 입장과 직원들이 위축되고 있다는 연구자들의 주장은 구분해 평가해야 한다. 회사의 보복 부인만으로 실제 문화적 영향까지 확인되지는 않는다.
  • 양측이 제3자 안전 감사자와 모델 감시 가능성 유지에 동의하더라도, 구체적인 해고 근거와 당시 적용된 규칙이 공개되지 않은 상태에서는 원칙과 실제 조치의 일치 여부가 남은 쟁점이다.

✅ 액션 아이템

  • OpenAI가 주장한 연구 정보 취급 정책 위반의 구체적 근거와 해고 경위 확인 필요.
  • Hugging Face 사건 대응과 모델 감시 가능성 연구에서 외부 협업에 적용된 규칙의 명확성 검토 필요.
  • 제3자 안전 감사자 배치, 최첨단 모델의 감시 가능성 유지, 열린 대화에 관한 OpenAI의 공개 약속 이행 여부 확인 필요.

❓ 열린 질문

  • OpenAI가 주장한 반복적 부적절 행위는 구체적으로 어떤 연구 정보 취급 정책을 위반했는가?
  • Hugging Face 사건 당시 실시간으로 마련되던 내부 정책은 Tomek Korbak의 외부 안전 평가자 협업에 어떤 기준을 적용했는가?
  • OpenAI는 제3자 안전 감사자와의 협업 및 열린 대화를 지원하면서 안전 우려를 제기하는 직원을 어떻게 보호하는가?

관련 문서

공통 태그와 주제 흐름을 기준으로 같이 보면 좋은 문서를 이어서 제안합니다.