Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#research-reporting
Tag1건Article 1

#research-reporting

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#attack-demonstration공동문서 1 · 연관도 100%#instruction-provenance-failure공동문서 1 · 연관도 100%#role-tag-confusion공동문서 1 · 연관도 100%#gpt-oss-20b공동문서 1 · 연관도 71%#llm-security공동문서 1 · 연관도 71%#instruction-hierarchy공동문서 1 · 연관도 45%#gpt-5공동문서 1 · 연관도 35%#prompt-injection-defense공동문서 1 · 연관도 32%#openai공동문서 1 · 연관도 4%#llm공동문서 1 · 연관도 3%
A fundamental flaw leaves LLMs strikingly vulnerable to attack
Article2026년 7월 30일

A fundamental flaw leaves LLMs strikingly vulnerable to attack

연구진은 대규모 언어 모델이 지시의 출처를 역할 태그보다 문체와 단어에 의존해 판별하는 구조적 약점 때문에 사고 과정 위조 공격에 속을 수 있으며, 훈련만으로 완전한 보안을 달성하기 어렵다고 주장한다.

technologyreview.com
#openai#gpt-5#gpt-oss-20b#instruction-provenance-failure