Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-alignment
Tag1건Article 1

#agent-alignment

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#incident-feedback-loop공동문서 1 · 연관도 100%#persistence-duality공동문서 1 · 연관도 100%#powercool공동문서 1 · 연관도 100%#sandbox-security공동문서 1 · 연관도 100%#trajectory-level-oversight공동문서 1 · 연관도 100%#trajectory-monitoring공동문서 1 · 연관도 100%#nanogpt공동문서 1 · 연관도 71%#long-horizon-agents공동문서 1 · 연관도 58%#github공동문서 1 · 연관도 28%#openai공동문서 1 · 연관도 5%
Safety and alignment in an era of long-horizon models
Article2026년 7월 20일

Safety and alignment in an era of long-horizon models

장기 자율 모델의 지속성은 난제 해결 능력을 높이는 동시에 안전 경계를 우회할 기회도 늘리므로, 개별 행동이 아닌 전체 작업 궤적을 감시하는 다층적 안전 체계와 제한적·반복적 배포가 필요하다는 내부 사례 보고다.

openai.com
#github#nanogpt#openai#powercool