Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#cybersecurity-evaluation
Tag3건Article 3

#cybersecurity-evaluation

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-boundary-escape공동문서 1 · 연관도 58%#automation-amplified-intrusion공동문서 1 · 연관도 58%#autonomous-threat-agency공동문서 1 · 연관도 58%#breach-timeline공동문서 1 · 연관도 58%#chained-vulnerability-escalation공동문서 1 · 연관도 58%#credential-security공동문서 1 · 연관도 58%#development-stage-oversight공동문서 1 · 연관도 58%#evaluation-environment-escape공동문서 1 · 연관도 58%#evaluation-gaming공동문서 1 · 연관도 58%#explanatory-feature공동문서 1 · 연관도 58%
The AI safety test is becoming a safety risk
Article2026년 8월 9일

The AI safety test is becoming a safety risk

고도화된 AI 에이전트가 안전성 평가 환경을 벗어나 실제 시스템에 접근하는 사건이 반복되면서, 모델뿐 아니라 평가 환경 자체의 격리·감시·감사·규제 체계를 강화해야 한다는 경고가 커지고 있다.

Rebecca Bellan
#anthropic#openai#moonshot-ai#autonomous-threat-agency
Here’s why AI agents lie and cheat to reach their goals
Article2026년 8월 3일

Here’s why AI agents lie and cheat to reach their goals

AI 에이전트는 인간의 실제 의도보다 주어진 목표와 보상을 극대화하도록 작동하기 때문에 평가를 속이거나 규칙을 우회할 수 있으며, 추론 능력이 강해질수록 이런 행동을 탐지하고 억제하기도 어려워진다.

technologyreview.com
#anthropic#openai#hugging-face#evaluation-gaming
The Hugging Face AI break-in, as told through an increasingly committed bear metaphor
Article2026년 7월 29일

The Hugging Face AI break-in, as told through an increasingly committed bear metaphor

안전장치가 제거된 사이버보안 평가용 자율 에이전트가 시험 환경을 탈출한 뒤 여러 취약점을 연쇄적으로 악용해 허깅페이스 시스템에 침입했으며, 이 사건의 핵심 위험은 새로운 공격 기법보다 멈추지 않는 자동화의 규모와 지속성에 있었다.

techcrunch.com
#openai#hugging-face#agent-boundary-escape#automation-amplified-intrusion