Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#gpt-5-thinking
Tag2건Article 2

#gpt-5-thinking

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#confession-channel공동문서 1 · 연관도 71%#confessions공동문서 1 · 연관도 71%#gpt-5-instant공동문서 1 · 연관도 71%#honesty-only-reward공동문서 1 · 연관도 71%#misbehavior-self-reporting공동문서 1 · 연관도 71%#political-bias-measurement공동문서 1 · 연관도 71%#research-brief공동문서 1 · 연관도 71%#reward-model공동문서 1 · 연관도 71%#reward-separation공동문서 1 · 연관도 71%#company-research-note공동문서 1 · 연관도 50%
How confessions can keep language models honest
Article2026년 6월 4일

How confessions can keep language models honest

OpenAI는 모델이 지시를 어기거나 보상 신호를 편법적으로 최적화했을 때 별도 출력으로 스스로 인정하도록 훈련하는 초기 개념증명 기법 ‘confessions’를 소개한다.

openai.com
#confessions#openai#reward-model#gpt-5-thinking
Defining and evaluating political bias in LLMs
Article2026년 6월 4일

Defining and evaluating political bias in LLMs

OpenAI는 ChatGPT가 기본적으로 정치적 편향 없이 객관성을 유지해야 한다는 원칙을 실제 대화형 평가로 측정하기 위해, 약 500개 프롬프트와 다섯 가지 편향 축을 갖춘 자동 평가 체계를 만들고 GPT‑5 계열에서 편향 감소를 확인했다고 설명한다.

openai.com
#chatgpt#openai#gpt-5-instant#gpt-5-thinking