ArticleOpenAI·2026년 8월 19일·0

Offering Zero Data Retention for frontier models

Quick Summary

OpenAI는 프런티어 모델의 장기·복합 작업에서 여러 상호작용에 걸친 위험을 탐지하되 고객 원문을 인력에게 노출하지 않는 Private Safety Processing으로 ZDR 약속을 유지하려 한다.

Offering Zero Data Retention for frontier models 관련 대표 이미지

🖼️ 인포그래픽

Offering Zero Data Retention for frontier models 내용을 설명하는 본문 이미지

🖼️ 4컷 인포그래픽

Offering Zero Data Retention for frontier models의 핵심 내용을 4단계로 요약한 인포그래픽
Offering Zero Data Retention for frontier models 핵심 내용을 4단계로 압축한 4컷 인포그래픽

💡 한 줄 요약

OpenAI는 프런티어 모델의 장기·복합 작업에서 여러 상호작용에 걸친 위험을 탐지하되 고객 원문을 인력에게 노출하지 않는 Private Safety Processing으로 ZDR 약속을 유지하려 한다.

📌 핵심 요약

  • ZDR은 자격을 갖춘 API 고객의 요청 처리 후 프롬프트와 모델 응답을 보관하지 않고, 고객 콘텐츠의 인력 검토와 명시적 동의 없는 기업 데이터의 모델 훈련 사용을 막는다.
  • 기존 ZDR 호환 안전 시스템은 상호작용을 개별 평가하지만, 보호장치 반복 탐색·계정 간 공조·에이전트의 중단 지시 불이행 같은 위험은 관련 상호작용 전체에서 드러날 수 있다.
  • Private Safety Processing은 고객 통제 인프라의 콘텐츠를 대상으로 작동하며, OpenAI는 고객 통제 키로 암호화하는 자사 저장소 선택지도 개발하고 있다.
  • 위험이 식별되면 OpenAI에는 활동 유형을 나타내는 제한된 안전 신호만 전달되고, 고객은 자체 시스템에서 경보와 집행 결정을 조사한 뒤 필요한 정보를 선택적으로 공유할 수 있다.
  • Private Safety Processing은 초기 고객과 시험 중이며, OpenAI는 9월부터 출시를 시작하고 기술 백서를 공개할 계획이다.

🧩 주요 포인트

  1. 단일 상호작용 중심의 기존 ZDR 안전 체계 → 장기·에이전트형 작업의 누적 위험을 판별하기 위한 맥락 확장이 필요하다.
  2. 고객 통제 저장소와 고객 통제 키 → OpenAI 인력의 원문 접근을 차단하면서 자동 위험 탐지를 수행하는 구조다.
  3. 제한된 안전 신호와 고객의 선택적 정보 공유 → 집행에 필요한 위험 정보와 기업의 데이터 통제권을 분리한다.

🧠 상세 정리

1. ZDR이 보장하는 데이터 통제

ZDR은 자격을 갖춘 API 고객에게 요청 처리가 끝난 뒤 OpenAI가 프롬프트와 모델 응답을 보관하지 않는다는 명확한 약속을 제공한다. 고객 콘텐츠는 OpenAI 인력이 검토할 수 없으며, 기업 고객 데이터도 고객이 명시적으로 동의하지 않는 한 모델 훈련에 사용되지 않는다. 이 약속은 콘텐츠의 사용 목적만 제한하는 것이 아니라 처리 후 미보존과 인력의 원문 접근 차단을 함께 포함한다. 일부 프런티어 모델 배포에서는 안전 감시를 위해 민감한 콘텐츠 보관이 요구됐지만, 이러한 조건은 여러 조직의 보안 의무나 이용자에 대한 약속과 충돌할 수 있다. Private Safety Processing은 더 넓은 맥락을 활용하는 안전 기능을 도입하면서도 ZDR을 계속 제공하기 위한 접근으로 제시된다.

2. 여러 상호작용에서 드러나는 안전 위험

기존 ZDR 호환 안전 시스템은 각각의 상호작용을 개별적으로 평가하지만, 심각한 위험이 항상 한 번의 요청에서 드러나는 것은 아니다. 잠재적으로 해로운 의도는 여러 상호작용을 함께 살펴볼 때 분명해질 수 있으며, 보호장치를 반복적으로 탐색하거나 여러 계정을 연계하고 위협을 일상적인 연구처럼 위장하는 사례가 제시된다. 에이전트형 작업에서는 사용자가 중단을 지시했는데도 시스템이 계속 행동해 사용자의 의도와 어긋나는 위험도 작업 과정에서 형성될 수 있다. 모델이 더 길고 복잡한 작업을 맡을수록 정상 활동과 오용을 구분하고 에이전트가 위임받은 권한 안에 머무는지 판단하려면 더 넓은 맥락이 필요하다. Private Safety Processing은 개별 평가만으로 포착하기 어려운 이러한 관련 상호작용의 패턴을 자동으로 식별하도록 설계됐다.

3. 고객 통제 저장소와 암호화 구조

ZDR 배포에서는 고객 콘텐츠가 고객이 통제하는 인프라에 그대로 유지되며, Private Safety Processing은 이 저장 위치의 콘텐츠를 이용해 관련 상호작용을 분석한다. OpenAI는 이와 별도로 고객 콘텐츠를 자사 인프라에 저장하되 고객이 통제하는 키로 암호화하는 선택지도 개발하고 있다. OpenAI 인력은 해당 암호화 키의 사본을 보유하지 않으므로 저장된 프롬프트와 응답의 원문에 접근할 수 없다. 고객 통제 인프라와 OpenAI 제공 저장소 중 어느 방식을 사용하더라도 자동화 시스템은 잠재적인 오용을 식별하고 제한된 안전 신호를 반환할 수 있다. 따라서 이 구조는 콘텐츠의 저장 위치와 관계없이 자동 보호 기능을 확장하면서 OpenAI 인력의 원문 접근을 허용하지 않는 것을 핵심 조건으로 삼는다.

4. 제한된 안전 신호와 집행 절차

Private Safety Processing이 위험을 식별하면 OpenAI는 관련 활동의 유형을 나타내는 좁게 정의된 안전 신호를 받는다. 이 신호는 집행이 필요한지 판단하는 데 사용될 수 있지만, 위험으로 표시된 경우에도 OpenAI 인력에게 고객 콘텐츠가 제공되지는 않는다. 즉, 자동화 시스템의 위험 탐지 결과와 사람이 열람할 수 있는 원문 데이터가 분리된 상태로 유지된다. 고객은 자체 시스템에서 확보할 수 있는 정보를 이용해 경보와 집행 결정을 직접 조사할 수 있다. 고객이 이의를 제기하거나 정상적인 활동임을 설명하거나 확인된 악용에 관한 조사를 지원하려는 경우에만 관련 정보를 OpenAI와 선택적으로 공유할 수 있다.

5. 민감정보 보호와 고객 공동 설계

OpenAI는 효과적인 보호장치를 구축하려면 고객 및 파트너와의 협력이 필요하며, 새롭게 등장하는 위험을 어느 한 AI 연구소가 단독으로 해결할 수 없다고 설명한다. Private Safety Processing은 산업·지역·기업 규모가 서로 다른 고객의 의견을 반영하며 설계되고 있다. 참여 조직들은 금융 기록, 건강 데이터, 기밀 사업 계획, 독점 연구처럼 각 분야에서 매우 민감한 정보를 취급한다. 이러한 정보에 대한 통제는 규제 의무 준수, 고객 신뢰 유지, 경쟁 우위 보존과 연결되므로 안전 기능이 데이터 통제권을 침해하지 않는 것이 중요하게 다뤄진다. Glean의 최고정보보안책임자는 OpenAI의 비훈련 약속과 ZDR이 기업의 AI 활용 신뢰를 뒷받침하며, 모델 역량이 커져도 프라이버시와 통제를 훼손하지 않고 안전을 발전시킬 수 있다고 평가했다.

6. 초기 시험과 9월 출시 계획

Private Safety Processing은 현재 초기 고객들과 시험 중이며, OpenAI는 모델 성능이 향상되는 상황에서도 콘텐츠 보호 방식에 대한 예측 가능성이 필요하다는 고객 의견을 반영해 미리 내용을 공개했다. 앞으로 고객과 함께 기술적·운영적 세부사항을 계속 조정할 예정이다. OpenAI는 9월부터 Private Safety Processing의 출시를 시작하고 같은 시기에 기술 백서를 공개할 계획이다. 또한 진행 상황을 고객에게 조기에 알리고, 각 변경이 기존 약속에 어떤 의미를 갖는지 설명하겠다고 밝혔다. 고객이 변화에 대비할 수 있도록 필요한 시간과 지원도 제공한다는 방침이며, 이 과정에서도 ZDR과 고객 데이터 통제라는 기존 원칙을 유지하는 것이 핵심 목표다.

🧾 핵심 주장 / 시사점

  • Private Safety Processing의 핵심은 고객 콘텐츠를 사람이 열람하지 않아도 관련 상호작용에서 위험 패턴을 탐지할 수 있도록 원문 접근과 안전 판단을 분리한 데 있다.
  • 고객 통제 인프라와 고객 통제 키는 저장 위치가 달라져도 OpenAI 인력의 접근을 차단한다는 동일한 데이터 통제 원칙을 유지한다.
  • 고객이 자체 시스템에서 집행 근거를 조사하고 필요한 정보만 선택적으로 공유하는 구조는 안전 집행 과정에서도 고객의 결정권을 보존한다.

✅ 액션 아이템

  • ZDR 대상 API 고객의 요청 처리 후 프롬프트·응답 미보존 조건 확인.
  • Private Safety Processing의 관련 상호작용 분석과 제한된 안전 신호 적용 범위 검토.
  • 9월 출시 및 기술 백서 공개 시 ZDR 약속의 기술·운영 세부사항 재확인.

❓ 열린 질문

  • ZDR 대상 API 고객은 고객 통제 인프라와 고객 통제 키 암호화 방식 중 어떤 저장 선택지를 이용할 수 있는가?
  • Private Safety Processing이 전달하는 제한된 안전 신호에는 위험 활동의 유형 외에 어떤 정보가 포함되는가?
  • 9월 공개 예정인 기술 백서는 ZDR 약속을 지키기 위한 기술·운영 세부사항을 어디까지 설명할 것인가?

관련 문서

공통 태그와 주제 흐름을 기준으로 같이 보면 좋은 문서를 이어서 제안합니다.