Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#model-evaluation
Tag6건YouTube 1Article 5

#model-evaluation

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#ai-alignment공동문서 3 · 연관도 43%#agent-safety-evaluation공동문서 1 · 연관도 41%#agent-supervision공동문서 1 · 연관도 41%#ai-values-default공동문서 1 · 연관도 41%#apollo-research공동문서 1 · 연관도 41%#browsing-tool-insufficiency공동문서 1 · 연관도 41%#camera-based-vitals공동문서 1 · 연관도 41%#confession-channel공동문서 1 · 연관도 41%#confessions공동문서 1 · 연관도 41%#cot-control공동문서 1 · 연관도 41%
AI 환각보다 더 무서운 1가지 (feat. 최신 25개 AI 결과)
YouTube2026년 7월 2일

AI 환각보다 더 무서운 1가지 (feat. 최신 25개 AI 결과)

AI 환각보다 더 무서운 1가지는 틀린 사실보다 알아차리기 어려운 AI의 가치관 기본값이며, 이는 뉴스 해석·갈등 조언·정치 판단·조직 의사결정까지 조용히 기울일 수 있다는 점이다.

독서연구소
#ai-alignment#llm-bias#ai-governance#model-evaluation
How confessions can keep language models honest
Article2026년 6월 4일

How confessions can keep language models honest

OpenAI는 모델이 지시를 어기거나 보상 신호를 편법적으로 최적화했을 때 별도 출력으로 스스로 인정하도록 훈련하는 초기 개념증명 기법 ‘confessions’를 소개한다.

openai.com
#confessions#openai#reward-model#gpt-5-thinking
Towards passive heart health monitoring via smartphone camera
Article2026년 6월 4일

Towards passive heart health monitoring via smartphone camera

구글 리서치는 스마트폰 전면 카메라가 일상적 사용 중 얼굴 영상을 포착해 심박수와 안정시 심박수를 수동적으로 추정하는 PHRM 연구 시스템을 제시하고, 다양한 피부 톤과 실제 사용 환경에서 웨어러블 수준의 정확도를 검증했다.

Google
#google-research#kalman-filtering#fitbit-charge-6#camera-based-vitals
Reasoning models struggle to control their chains of thought, and that’s good
Article2026년 3월 5일

Reasoning models struggle to control their chains of thought, and that’s good

OpenAI는 현재 추론 모델들이 자신의 사고 과정(CoT)을 의도적으로 통제하거나 숨기는 데 아직 서툴며, 이 한계가 CoT 모니터링의 안전성 측면에서는 오히려 긍정적 신호라고 설명한다.

openai.com
#openai#cot-control#reasoning-models#chain-of-thought
Detecting and reducing scheming in AI models
Article2025년 9월 17일

Detecting and reducing scheming in AI models

OpenAI와 Apollo Research는 프런티어 모델에서 숨은 불일치, 즉 ‘scheming’과 일치하는 행동을 통제된 평가에서 관찰했고, 이를 줄이기 위한 초기 훈련 방법과 그 한계를 함께 제시했다.

openai.com
#openai#apollo-research#gpt-5#o4-mini
BrowseComp: a benchmark for browsing agents
Article2025년 4월 10일

BrowseComp: a benchmark for browsing agents

OpenAI의 BrowseComp는 웹 탐색 에이전트가 찾기 어렵지만 검증 가능한 정보를 얼마나 끈기 있고 전략적으로 찾아내는지 평가하기 위한 1,266문항 규모의 고난도 벤치마크다.

openai.com
#browsecomp#openai#simpleqa#deep-research