Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#model-compression
Tag2건Article 2

#model-compression

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#accuracy-preserving-compression공동문서 1 · 연관도 71%#attention-guided-pruning공동문서 1 · 연관도 71%#block-sparsification공동문서 1 · 연관도 71%#feature-selection공동문서 1 · 연관도 71%#gemma-4-e2b공동문서 1 · 연관도 71%#gemma-4-e4b공동문서 1 · 연관도 71%#mobile-ai공동문서 1 · 연관도 71%#neural-network-pruning공동문서 1 · 연관도 71%#orthogonal-matching-pursuit공동문서 1 · 연관도 71%#sequential-attention공동문서 1 · 연관도 71%
Gemma 4 QAT models: Optimizing model compression for mobile and laptop efficiency
Article2026년 6월 5일

Gemma 4 QAT models: Optimizing model compression for mobile and laptop efficiency

Google은 Gemma 4 모델군에 양자화 인식 학습(QAT)을 적용한 새 체크포인트를 공개해 메모리 요구량을 크게 낮추고 온디바이스 실행 효율을 높였다고 밝혔다.

Google
#google#gemma-4#gemma-4-e2b#gemma-4-e4b
​Sequential Attention: Making AI models leaner and faster without sacrificing accuracy
Article2026년 2월 4일

​Sequential Attention: Making AI models leaner and faster without sacrificing accuracy

구글 리서치는 대규모 딥러닝 모델의 부분집합 선택 문제를 학습 과정 안에서 순차적 attention 기반으로 해결해, 정확도를 유지하면서 모델을 더 작고 빠르게 만드는 Sequential Attention을 소개했다.

research.google
#sequentialattention#google-research#sequential-attention#orthogonal-matching-pursuit