Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#inference-throughput
Tag2건Article 2

#inference-throughput

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#amd-mi300x공동문서 1 · 연관도 71%#capacity-gated-access공동문서 1 · 연관도 71%#data-center-gpus공동문서 1 · 연관도 71%#frontier-model-speedup공동문서 1 · 연관도 71%#llm-inference공동문서 1 · 연관도 71%#quality-latency-tradeoff공동문서 1 · 연관도 71%#raynerformer-2b공동문서 1 · 연관도 71%#ultrafast공동문서 1 · 연관도 71%#vendor-performance-claim공동문서 1 · 연관도 71%#nvidia-h200공동문서 1 · 연관도 41%
Kog is going deeper to squeeze more inference out of GPUs
Article2026년 8월 14일

Kog is going deeper to squeeze more inference out of GPUs

프랑스 스타트업 코그는 기존 데이터센터용 GPU를 저수준 소프트웨어로 최적화해 대규모 언어 모델의 추론 속도를 높이려 하지만, 소형 모델에서 거둔 성과를 주요 대형 모델에서도 재현해야 한다.

Anna Heim
#amd-mi300x#nvidia-h200#raynerformer-2b#llm
OpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed
Article2026년 8월 13일

OpenAI introduces 'Ultrafast,' a new mode that makes GPT-5.6 Sol work at 14x the speed

오픈AI는 GPT 5.6 솔의 처리 속도를 표준 방식보다 최대 14배 높여 초당 최대 750개의 출력 토큰을 생성하는 ‘울트라패스트’ 모드를 제한적으로 공개했습니다.

Lucas Ropek
#cerebras#openai#ultrafast#capacity-gated-access