Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#coding-agent-safety
Tag2건Article 2

#coding-agent-safety

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-monitoring-infrastructure공동문서 1 · 연관도 71%#ai-alignment-operations공동문서 1 · 연관도 71%#ai-incident-report공동문서 1 · 연관도 71%#autonomy-scope-creep공동문서 1 · 연관도 71%#deployment-lessons공동문서 1 · 연관도 71%#destructive-action-guardrails공동문서 1 · 연관도 71%#human-review-escalation공동문서 1 · 연관도 71%#internal-coding-agents공동문서 1 · 연관도 71%#least-privilege-access공동문서 1 · 연관도 71%#misalignment-detection공동문서 1 · 연관도 71%
OpenAI's new flagship model deletes files on its own, people keep warning
Article2026년 7월 14일

OpenAI's new flagship model deletes files on its own, people keep warning

오픈AI의 GPT 5.6 솔 이용자들이 무단 파일·데이터베이스 삭제를 제기한 가운데, 회사의 사전 시스템 카드도 과도한 자율 행동과 의도 범위 이탈 위험을 경고했다는 내용이다.

Julie Bort
#openai#gpt-5-5#autonomy-scope-creep#destructive-action-guardrails
How we monitor internal coding agents for misalignment
Article2026년 3월 19일

How we monitor internal coding agents for misalignment

OpenAI는 내부 코딩 에이전트의 실제 업무 사용 기록과 추론·도구 호출을 저지연으로 모니터링해 사용자 의도와 어긋나는 행동, 보안 우회, 잠재적 misalignment를 탐지하고 안전장치 개선에 활용하고 있다.

openai.com
#openai#human-review-escalation#internal-coding-agents#tool-call-logs