Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#benchmark-case-study
Tag3건Article 3

#benchmark-case-study

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-security공동문서 1 · 연관도 58%#amazon-sagemaker공동문서 1 · 연관도 58%#arc-agi-3공동문서 1 · 연관도 58%#attacker-defender-coevolution공동문서 1 · 연관도 58%#compression-over-truncation공동문서 1 · 연관도 58%#deployment-aligned-evaluation공동문서 1 · 연관도 58%#deployment-recommendation공동문서 1 · 연관도 58%#endpoint-load-testing공동문서 1 · 연관도 58%#harness-sensitive-performance공동문서 1 · 연관도 58%#latency-throughput-tradeoff공동문서 1 · 연관도 58%
LLM optimization integration for Amazon SageMaker Python SDK
Article2026년 8월 6일

LLM optimization integration for Amazon SageMaker Python SDK

Amazon SageMaker Python SDK v3는 생성형 AI 모델의 추론 구성을 실제 워크로드로 시험하고, 성능·비용 기준의 추천을 생성해 최적 구성을 노트북에서 바로 배포할 수 있도록 통합했습니다.

aws.amazon.com
#amazon-sagemaker#ml-g6-2xlarge#sagemaker-python-sdk#latency-throughput-tradeoff
How enabling two settings tripled our scores on the ARC-AGI-3 benchmark
Article2026년 7월 29일

How enabling two settings tripled our scores on the ARC-AGI-3 benchmark

ARC AGI 3에서 추론 기록 유지와 컨텍스트 압축을 활성화하자 GPT‑5.6 Sol의 공개 과제 점수는 13.3%에서 38.3%로 약 3배 높아지고 출력 토큰은 6분의 1로 줄었다.

openai.com
#openai#responses-api#arc-agi-3#compression-over-truncation
GPT-Red: Unlocking Self-Improvement for Robustness
Article2026년 7월 15일

GPT-Red: Unlocking Self-Improvement for Robustness

GPT‑Red는 공격자와 방어자를 함께 강화하는 자기대전 학습으로 새로운 프롬프트 인젝션을 발굴하고, 그 공격 데이터를 GPT‑5.6 Sol 훈련에 활용해 실제 능력을 유지하면서 강건성을 높이려는 내부 전용 자동 레드팀 모델이다.

openai.com
#openai#gpt-red#attacker-defender-coevolution#robustness-capability-balance