Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#model-scaling
Tag11건YouTube 2Article 9

#model-scaling

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#accuracy-preserving-compression공동문서 1 · 연관도 30%#agent-swarm-scaling공동문서 1 · 연관도 30%#ai-power-concentration공동문서 1 · 연관도 30%#anthropic-governance공동문서 1 · 연관도 30%#attention-guided-pruning공동문서 1 · 연관도 30%#attention-residue공동문서 1 · 연관도 30%#block-sparsification공동문서 1 · 연관도 30%#cheap-verification-tasks공동문서 1 · 연관도 30%#feature-selection공동문서 1 · 연관도 30%#frontier-model-scaling공동문서 1 · 연관도 30%
SensorFM: Towards a general intelligence and interface for wearable health data
Article2026년 7월 9일

SensorFM: Towards a general intelligence and interface for wearable health data

SensorFM은 500만 명의 비식별 웨어러블 센서 데이터 1조 분 이상을 자기지도 방식으로 학습해 다양한 건강 예측, 결측 데이터 복원, 적은 라벨을 활용한 적응, 개인 건강 에이전트의 생리학적 근거 제공을 지원하는 범용 파운데이션 모델이다.

research.google
#model-scaling#ai-architecture#multimodal#llm
Introducing container caching in Amazon SageMaker AI for faster model scaling
Article2026년 6월 16일

Introducing container caching in Amazon SageMaker AI for faster model scaling

Amazon SageMaker AI는 추론 엔드포인트의 신규 인스턴스 확장 시 컨테이너 이미지를 미리 캐시해 이미지 다운로드 병목을 제거하고, 생성형 AI 모델의 스케일아웃 지연을 최대 약 2배 단축한다고 발표했습니다.

aws.amazon.com
#model-scaling#service-design#llm#semiconductors
Unweight: how we compressed an LLM 22% without sacrificing quality
Article2026년 4월 17일

Unweight: how we compressed an LLM 22% without sacrificing quality

Unweight는 LLM 가중치의 BF16 지수 바이트를 무손실로 압축하고 GPU 온칩 메모리에서 바로 복원해, 출력 품질을 유지하면서 모델 크기와 HBM 메모리 대역폭 부담을 줄이는 추론용 압축 시스템이다.

blog.cloudflare.com
#model-scaling#ai-architecture#agent-memory#context-compression
How We Scaled Kimi K2.5
YouTube2026년 3월 21일

How We Scaled Kimi K2.5

오픈 모델을 진짜 경쟁력 있게 만들려면 단순 공개를 넘어, 토큰 효율·긴 컨텍스트·에이전트 스웜이라는 세 축을 함께 확장하고 초대형 학습의 안정성까지 해결해야 한다는 것이 이번 키노트의 핵심입니다.

Kimi AI
#agent-swarm-scaling#gtc-keynote#kimi-ai#kimi-k2-5
인공지능은 쓰나미" (앤트로픽 CEO 인터뷰)
YouTube2026년 3월 14일

인공지능은 쓰나미" (앤트로픽 CEO 인터뷰)

이 인터뷰는 AI를 이미 인간 수준에 가까워진 범용 인지 도구로 보며, 앞으로의 핵심 쟁점은 성능 경쟁보다 권력 집중·사회적 통제·안전한 거버넌스를 어떻게 설계하느냐에 있다고 말한다.

비즈까페
#anthropic-governance#ceo-interview#anthropic#openai
​Sequential Attention: Making AI models leaner and faster without sacrificing accuracy
Article2026년 2월 4일

​Sequential Attention: Making AI models leaner and faster without sacrificing accuracy

구글 리서치는 대규모 딥러닝 모델의 부분집합 선택 문제를 학습 과정 안에서 순차적 attention 기반으로 해결해, 정확도를 유지하면서 모델을 더 작고 빠르게 만드는 Sequential Attention을 소개했다.

research.google
#sequentialattention#google-research#sequential-attention#orthogonal-matching-pursuit
Forecasting the future of forests with AI: From counting losses to predicting risk
Article2025년 11월 5일

Forecasting the future of forests with AI: From counting losses to predicting risk

ForestCast는 위성 데이터와 딥러닝을 활용해 산림 손실을 사후 집계하는 데서 나아가, 미래의 산림 벌채 위험을 예측하기 위한 공개 벤치마크와 모델 접근법을 제시한다.

research.google
#model-scaling#ai-distribution#search-advertising#zero-click-search
Judge Arena: Benchmarking LLMs as Evaluators
Article2025년 9월 18일

Judge Arena: Benchmarking LLMs as Evaluators

Judge Arena는 LLM 평가자들을 익명·무작위 대결 방식으로 비교하고, 사람들의 투표를 Elo 리더보드로 집계해 어떤 모델이 더 나은 ‘판사’인지 벤치마킹하려는 플랫폼이다.

huggingface.co
#anthropic#model-scaling#context-compression#prompt-library
Bamba: Inference-Efficient Hybrid Mamba2 Model
Article2024년 9월 25일

Bamba: Inference-Efficient Hybrid Mamba2 Model

Bamba 9B는 KV cache 병목을 줄이기 위해 Mamba2와 트랜스포머를 결합한 9B급 하이브리드 모델로, 공개 데이터로 학습되고 주요 오픈소스 추론·학습 생태계에서 바로 실험할 수 있도록 공개된 모델이다.

huggingface.co
#model-scaling#ai-architecture#agent-memory#context-compression
Algorithmic progress in language models
Article2024년 3월 12일

Algorithmic progress in language models

Epoch AI는 사전학습 언어모델에서 같은 성능에 필요한 컴퓨트가 약 8개월마다 절반으로 줄었지만, 지난 10년의 성능 향상은 알고리즘 혁신보다 컴퓨트와 데이터 확장의 영향이 더 컸다고 분석한다.

Anson Ho
#model-scaling#ai-architecture#capex-cycle#llm
Trading off compute in training and inference
Article2023년 7월 28일

Trading off compute in training and inference

Epoch AI는 훈련 컴퓨트와 추론 컴퓨트가 일정 범위에서 서로 대체될 수 있으며, 특히 대규모 배포 모델에서는 추론 비용 최적화와 고성능 소규모 사용 사이의 균형이 중요하다고 분석한다.

Pablo Villalobos
#epoch-ai#gpt-3#gpt-4#pablo-villalobos