Expanding Daybreak as the Cyber Defense Window Narrows
Quick Summary
OpenAI는 승인된 방어자를 위한 Daybreak Blue·Daybreak Red를 확대하고, 고급 사이버 작업의 거절을 줄인 GPT‑5.6‑Cyber를 공개하면서 작업별 성능 차이와 접근 통제 강화 방안을 제시했다.
🖼️ 인포그래픽

🖼️ 4컷 인포그래픽

💡 한 줄 요약
OpenAI는 승인된 방어자를 위한 Daybreak Blue·Daybreak Red를 확대하고, 고급 사이버 작업의 거절을 줄인 GPT‑5.6‑Cyber를 공개하면서 작업별 성능 차이와 접근 통제 강화 방안을 제시했다.
📌 핵심 요약
- Daybreak Blue는 GPT‑5.6 Sol 등 범용 모델을 활용하는 대부분의 방어자에게 권장되며, Daybreak Red는 승인된 취약점 연구·익스플로잇 검증·보안 테스트를 위한 사이버 보안 특화 모델인 GPT‑5.6‑Cyber를 제공한다.
- 고급 사이버 요청의 응답 완료율을 측정한 내부 평가에서 GPT‑5.6‑Cyber는 95.0%, GPT‑5.6 Sol은 1.5%, Daybreak Blue를 통한 GPT‑5.6 Sol은 2.0%, GPT‑5.5‑Cyber는 57.3%를 기록했다.
- GPT‑5.6‑Cyber는 ExploitGym과 내부 제로데이 평가에서 비교 모델보다 우수했지만, 취약점 발견·보고서 작성 평가에서는 GPT‑5.6 Sol보다 낮은 성능을 보였다. ExploitBench의 기본 300턴 조건에서도 GPT‑5.6 Sol이 가장 우수했고, 600턴으로 늘리면 두 모델의 격차가 줄었다.
- OpenAI는 GPT‑5.6‑Cyber로 V8의 미공개 취약점 2개를 발견해 Google에 신고했으며, Google은 CVE-2026-15903을 부여하고 수정했다. 이 밖에도 모바일 운영체제에서 최소 5개, 데이터베이스에서 치명적 취약점 3개, 운영체제 커널에서 권한 상승으로 이어질 수 있는 취약점 400개 이상을 발견했다고 밝혔다.
- GPT‑5.6‑Cyber의 사이버 역량은 대비 프레임워크상 높음 등급이며 임계 등급에는 미달했다. Daybreak는 승인된 작업과 신원 확인 등으로 접근을 제한하고, Codex 자동 검토 모드 사용을 권장하며, 2026년 9월 1일부터 모든 개인 계정에 하드웨어 보안 키를 요구한다.
🧩 주요 포인트
- Daybreak Blue·Daybreak Red의 접근 구분과 응답 완료율 차이 → 일반 방어 업무와 고급 이중용도 연구에서 필요한 모델 접근 수준이 달라진다.
- 평가별 우열과 300턴·600턴 조건에 따른 격차 변화 → GPT‑5.6‑Cyber의 특화 성능을 해석할 때 보고서 품질과 작업 예산을 함께 고려해야 한다.
- 실제 취약점 발견 확대와 접근 통제 강화 → Daybreak의 방어 활용은 취약점 검증·수정뿐 아니라 승인된 작업 범위와 계정 보호를 함께 전제로 한다.
🧠 상세 정리
1. 방어 준비 시간의 단축과 두 접근 등급
OpenAI는 2026년 8월 10일 발표에서 공격자가 인공지능을 활용해 전례 없는 속도와 규모로 공격하고, 완전히 자율적인 공격까지 수행할 가능성이 커지면서 방어자의 준비 시간이 줄고 있다고 설명했다. 이에 대한 대응으로 공격용 인공지능이 대규모로 배치되기 전에 신뢰할 수 있는 방어자에게 최첨단 모델 역량을 제공한다는 방향을 제시했다. Daybreak Blue는 GPT‑5.6 Sol 등 범용 모델을 제공하며, 취약점 발견·보안 코드 검토·악성코드 분석·사고 대응·패치 검증을 수행하는 대부분의 방어자에게 권장된다. Daybreak Red는 승인된 취약점 연구와 익스플로잇 검증, 보안 테스트를 위한 특화 모델 접근을 제공한다. 새로 소개한 GPT‑5.6‑Cyber는 GPT‑5.6 Sol을 기반으로 전문 사이버 작업 성능을 높이고 일부 고위험 이중용도 요청의 거절을 줄이도록 훈련됐으며, Daybreak Red를 통해 제공된다.
2. 안전장치 조정과 고급 요청의 완료율
OpenAI는 일반 서비스에서 사이버 요청을 검사하는 시스템 수준 안전장치가 악용을 막지만, 정당한 방어 작업도 차단할 수 있다고 설명했다. Daybreak Blue는 해당 안전장치를 제거해 보안 업무를 지원하지만, GPT‑5.6 Sol 자체는 실제 운영 시스템의 침투 테스트처럼 이중용도성이 높은 요청을 여전히 거절할 수 있다. 내부 고급 사이버 보안 완료율 평가는 익스플로잇 체인 개발, 인증 우회, 권한 상승 등의 요청에 모델이 응답을 완료하는 비율을 측정했다. GPT‑5.6‑Cyber는 95.0%를 기록했으며, 일반 GPT‑5.6 Sol은 1.5%, Daybreak Blue의 GPT‑5.6 Sol은 2.0%, GPT‑5.5‑Cyber는 57.3%였다. 이는 이전 특화 모델에서도 거절이 계속됐다는 연구자 의견에 대응한 결과이며, 이 수치는 실제 공격 성공률이 아니라 요청 응답 완료율을 나타낸다. 원문은 macOS Keychain 보호 우회와 Chrome 쿠키 복호화 요청을 사례로 들어 GPT‑5.6‑Cyber와 다른 모델들의 응답 여부 차이를 보여준다.
3. 익스플로잇 개발과 제로데이 평가의 개선
GPT‑5.6‑Cyber의 특화 훈련은 익스플로잇 개발과 고급 보안 연구에 관련된 일부 작업의 성능 향상을 목표로 한다. ExploitGym은 통제된 환경에서 알려진 취약점을 실제로 작동하는 익스플로잇으로 전환하고 임의 코드 실행을 달성할 수 있는지 평가한다. 이 평가에서 GPT‑5.6‑Cyber는 GPT‑5.6 Sol과 GPT‑5.5‑Cyber를 모두 앞섰다고 원문은 설명한다. 별도의 내부 제로데이 평가에서는 최신 공개 버전의 오픈소스 저장소를 제공하고, 가능한 최대 영향을 입증하는 개념 증명 익스플로잇과 기술 설명을 작성하도록 했다. 평가 기준은 발견 내용의 심각도와 영향, 심각도 판단의 적절성, 기술 설명의 품질이며, Daybreak Red의 GPT‑5.6‑Cyber는 Daybreak Blue의 GPT‑5.6 Sol보다 우수했다. 다만 제공된 본문에는 두 평가의 구체적인 점수가 제시되지 않아 개선 폭을 수치로 확인할 수는 없다.
4. 보고서 품질과 작업 예산에 따른 성능 차이
내부 취약점 발견·보고서 작성 평가는 알려진 취약점이 있는 저장소에서 심각하고 조치 가능한 취약점을 찾고, 작동하는 개념 증명과 고품질 보고서를 제출하는 능력을 평가한다. 두 GPT‑5.6 모델은 GPT‑5.5‑Cyber보다 개선됐지만, GPT‑5.6‑Cyber는 GPT‑5.6 Sol보다 낮은 성능을 보였으며 OpenAI는 때때로 더 짧고 상세함이 부족한 보고서를 작성한 점을 원인으로 추정했다. ExploitBench는 V8 취약점을 완전한 익스플로잇으로 발전시키는 능력을 평가하며, V8 샌드박스 등 방어 기능을 더 많이 유지하고 취약점 정보도 적게 제공해 ExploitGym보다 어렵다. 기본 300턴 조건에서는 Daybreak Blue의 GPT‑5.6 Sol이 토큰을 더 효율적으로 사용하면서 가장 좋은 성능을 보였고, 600턴으로 확대하면 두 모델의 격차가 줄었다. 한 초기 고객은 GPT‑5.6‑Cyber가 실제 익스플로잇 제약과 복잡한 상태를 더 잘 다루며, 이전 모델이 수주간의 간헐적 시도로 해결하지 못한 작업을 하루 이내에 완료했다고 전했다. 이러한 결과는 전문 작업의 개선과 함께 보고서 품질 및 작업 조건에 따른 한계도 보여준다.
5. V8 취약점 발견과 Google의 수정
OpenAI는 실제 취약점 연구에 낯선 대규모 코드베이스를 대상으로 한 지속적인 추론, 가설 검증, 구성요소 간 상호작용 추적과 재현이 필요하다고 설명했다. GPT‑5.6‑Cyber 훈련 완료 후 Chrome의 자바스크립트 엔진인 V8을 조사해, 결합하면 메모리 손상과 V8 힙 샌드박스 탈출로 이어질 수 있는 미공개 취약점 2개를 발견했다. 연구진은 발견 내용을 검증한 뒤 조율된 취약점 공개 절차로 Google에 신고했으며, 원문은 Google이 CVE-2026-15903을 부여하고 수정했다고 밝혔다. 해당 고위험 취약점은 최적화 컴파일러가 정수 변환 과정의 안전 검사를 잘못 생략해 정의되지 않은 값이 예상보다 큰 숫자로 변환되는 문제다. 이 숫자가 배열 인덱스로 사용되면 경계 검사도 생략될 수 있어 다른 객체의 메모리를 읽거나 덮어쓰고 Chrome 샌드박스 내부에서 임의 코드를 실행할 가능성이 생긴다. 원문은 힙 샌드박스 탈출에는 일반적으로 두 번째 취약점이 필요하며, GPT‑5.6‑Cyber가 그 취약점도 발견했다고 설명한다.
6. 모바일 운영체제·데이터베이스·커널로 확장된 발견
OpenAI는 V8 외에도 모바일 운영체제, 데이터베이스, 운영체제 커널에서 GPT‑5.6‑Cyber를 활용해 심각한 보안 문제를 발견했다고 밝혔다. 이름을 공개하지 않은 널리 사용되는 모바일 운영체제에서는 최소 5개의 취약점을 찾았으며, 신뢰할 수 없는 앱에서 로컬 권한 상승으로 이어지는 취약점 체인이 포함됐다. 역시 제품명을 밝히지 않은 데이터베이스에서는 원격 코드 실행 경로를 포함한 치명적 취약점 3개를 발견했다고 설명했다. 널리 사용되는 운영체제 커널에서는 권한 상승으로 이어질 수 있는 취약점 400개 이상을 확인했다고 밝혔다. OpenAI는 이 모바일 운영체제·데이터베이스·커널 취약점의 공개와 해결을 위해 Daybreak 파트너 및 오픈소스 커뮤니티와 협력하고 있다고 설명했다. 제공된 본문에는 각 제품명이나 개별 취약점의 수정 완료 여부가 없어, Google의 수정이 명시된 V8 사례와 같은 상태로 단정할 수 없다.
7. 대비 프레임워크 평가와 공개 범위
OpenAI는 대비 프레임워크에서 GPT‑5.6 Sol의 사이버 보안 역량을 높음 등급으로 평가했으며, 임계 등급에는 도달하지 않았다고 설명했다. GPT‑5.6‑Cyber도 출시 전 최첨단 사이버 역량을 평가받았고, 동일하게 높음 등급에 해당하지만 임계 등급에는 미달한다고 판단했다. 직접 훈련한 일부 전문 사이버 작업에서는 GPT‑5.6 Sol보다 개선됐으나, 그 개선이 임계 등급에 도달할 정도는 아니라는 설명이다. 이 판단은 특정 전문 평가에서의 성능 향상과 대비 프레임워크의 역량 등급을 구분해 제시한 것이다. 원문은 GPT‑5.6‑Cyber가 Hugging Face 공격에 관여하지 않았고, 향후 출시 예정인 다른 모델도 관여하지 않았다고 명시했다. 추가 평가를 담은 시스템 카드는 추후 공개할 예정이라고 밝혔으므로, 제공된 본문에 담긴 등급 설명 외의 세부 평가 결과까지 확인할 수 있는 것은 아니다.
8. 승인된 접근과 추가 안전조치
OpenAI는 안전장치가 줄어든 모델 사용에 악용이나 정렬 실패에 따른 추가 위험이 있음을 인정하면서도, 방어자의 접근 확대가 사이버 방어의 가속과 자동화에 중요하다고 주장했다. Daybreak Blue와 Daybreak Red는 승인된 작업을 수행하는 개인과 조직에 제공되며, 신원 확인·계정 보안·모니터링·허용된 사용 범위 제한·법적 확약으로 접근을 통제한다. Codex를 사용하는 Daybreak 고객에게는 앱 기본값과 사용자 인터페이스를 통해 전체 접근 모드에서 자동 검토 모드로 전환하도록 강하게 권장한다. 자동 검토는 높은 권한이 필요한 행동을 실행 전에 평가하고, 파괴적 행동의 위험이 큰 요청을 차단할 수 있다. 모든 Daybreak 개인 계정에는 2026년 9월 1일부터 하드웨어 보안 키 도입을 요구하며, 개선된 모니터링을 포함한 추가 보안조치를 향후 수주 내 도입할 계획이라고 밝혔다. 또한 향후 Daybreak 출시에서는 정렬 훈련과 테스트를 우선한다고 설명했으며, 제공된 원문의 마지막 문장은 Codex 안전 모범 사례 문서 업데이트를 언급하다가 끝난다.
🧾 핵심 주장 / 시사점
- Daybreak Blue에서 시스템 수준 안전장치를 제거해도 고급 요청 완료율은 2.0%에 머물렀다는 결과는, 접근 설정 조정과 GPT‑5.6‑Cyber의 특화 훈련이 서로 다른 역할을 한다는 점을 보여준다.
- GPT‑5.6‑Cyber의 전문 평가 개선이 보고서 작성과 제한된 작업 예산에서도 일관된 우위를 뜻하지는 않는다. 모델 선택에는 요청 완료 여부 외에 보고서 품질과 실행 효율도 관련된다.
- V8 사례는 모델의 발견 이후 연구진 검증, 조율된 신고, Google의 수정으로 이어졌다. 다른 제품군의 대규모 발견 수치는 공개·수정 협력이 진행 중이라는 상태와 함께 해석해야 한다.
✅ 액션 아이템
- 일반 방어 업무와 고급 취약점 연구의 차이를 기준으로 Daybreak Blue·Daybreak Red의 적합성 검토.
- GPT‑5.6‑Cyber와 GPT‑5.6 Sol 비교 시 보고서 품질과 300턴·600턴 작업 예산을 함께 고려.
- Daybreak 개인 계정의 2026년 9월 1일 하드웨어 보안 키 요구사항과 Codex 자동 검토 모드 권장사항 확인.
❓ 열린 질문
- 수행할 작업은 Daybreak Blue가 권장되는 일반 방어 업무와 Daybreak Red의 고급 취약점 연구 중 어디에 해당하는가?
- 보고서 품질과 300턴·600턴 작업 예산을 고려할 때 GPT‑5.6‑Cyber와 GPT‑5.6 Sol 중 어느 모델이 더 적합한가?
- 발견된 모바일 운영체제 최소 5개·데이터베이스 3개·운영체제 커널 400개 이상 취약점의 검증과 수정은 각각 어느 단계에 있는가?