Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#nvidia
Tag419건YouTube 182Article 237

#nvidia

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#ai-infrastructure공동문서 158 · 연관도 45%#capex-cycle공동문서 141 · 연관도 42%#gpu공동문서 57 · 연관도 31%#jensen-huang공동문서 38 · 연관도 29%#applications공동문서 168 · 연관도 25%#llm공동문서 178 · 연관도 24%#ai-architecture공동문서 88 · 연관도 19%#sk-hynix공동문서 46 · 연관도 19%#semiconductor-supply-chain공동문서 22 · 연관도 18%#multimodal공동문서 50 · 연관도 17%
Open Source Developers Guide to the EU AI Act
Article2024년 12월 2일

Open Source Developers Guide to the EU AI Act

EU AI Act는 오픈소스 AI에도 적용될 수 있으며, 개발자는 시스템·모델의 위험 수준과 공개 방식에 따라 투명성, 학습 데이터 요약, 저작권 및 개인정보 보호 의무를 준비해야 한다.

huggingface.co
#privacy-design#llm#semiconductors#applications
NVIDIA's GTC 2025 Announcement for Physical AI Developers: New Open Models and Datasets
Article2024년 10월 16일

NVIDIA's GTC 2025 Announcement for Physical AI Developers: New Open Models and Datasets

엔비디아는 GTC 2025에서 물리 AI 개발을 가속하기 위해 Cosmos Transfer, Physical AI Dataset, Isaac GR00T N1을 공개했다.

huggingface.co
#nvidia#cosmos-transfer#hugging-face#robot-posttraining
Bamba: Inference-Efficient Hybrid Mamba2 Model
Article2024년 9월 25일

Bamba: Inference-Efficient Hybrid Mamba2 Model

Bamba 9B는 KV cache 병목을 줄이기 위해 Mamba2와 트랜스포머를 결합한 9B급 하이브리드 모델로, 공개 데이터로 학습되고 주요 오픈소스 추론·학습 생태계에서 바로 실험할 수 있도록 공개된 모델이다.

huggingface.co
#model-scaling#ai-architecture#agent-memory#context-compression
Mini-R1: Reproduce Deepseek R1 „aha moment“ a RL tutorial
Article2024년 9월 25일

Mini-R1: Reproduce Deepseek R1 „aha moment“ a RL tutorial

3B 규모의 큐원 모델을 카운트다운 산술 과제와 그룹 상대 정책 최적화로 훈련해, 별도의 인간 피드백 없이 풀이를 검토하고 탐색하는 딥시크 R1의 작은 ‘아하 순간’을 재현한 강화학습 실험이다.

huggingface.co
#nvidia#service-design#agent-memory#capex-cycle
Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub
Article2024년 9월 25일

Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub

엔비디아 라마 네모트론 나노 VL은 복잡한 문서의 문자·표·차트·수식·배치를 정밀하게 인식하고 위치 정보까지 제공하도록 설계된 80억 매개변수급 시각언어모델이다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-routing
Introducing HUGS - Scale your AI with Open Models
Article2024년 9월 9일

Introducing HUGS - Scale your AI with Open Models

HUGS는 Hugging Face가 공개 모델을 자체 인프라에서 빠르게 배포·확장하도록 제안한 무설정 최적화 추론 마이크로서비스였으며, 2025년 9월 기준 해당 모델 배포 컨테이너 제공은 중단되었다.

huggingface.co
#service-design#agent-deployment#ai-safety#llm
Remote VAEs for decoding with Inference Endpoints 🤗
Article2024년 8월 16일

Remote VAEs for decoding with Inference Endpoints 🤗

고해상도 이미지·영상 생성에서 큰 메모리를 차지하는 가변 오토인코더 디코딩을 원격 추론 엔드포인트에 맡겨 소비자용 그래픽 처리 장치의 부담을 줄이고 생성과 디코딩을 병렬화하는 실험적 기능을 소개한다.

huggingface.co
#agent-memory#agent-routing#capex-cycle#retrieval-index
Train 400x faster Static Embedding Models with Sentence Transformers
Article2024년 8월 9일

Train 400x faster Static Embedding Models with Sentence Transformers

이 글은 Sentence Transformers로 정적 임베딩 모델을 현대식 대조학습과 Matryoshka Representation Learning으로 학습해 CPU 추론 속도를 기존 주요 임베딩 모델보다 100~400배 높이면서도 여러 벤치마크에서 성능의 상당 부분을 유지하는 방법을 소개한다.

huggingface.co
#luxury-hospitality#luxury-travel#ai-architecture#multimodal
Welcome EmbeddingGemma, Google's new efficient embedding model
Article2024년 2월 21일

Welcome EmbeddingGemma, Google's new efficient embedding model

임베딩젬마는 3억 800만 개 매개변수와 2,048토큰 문맥 길이, 100개 이상 언어 지원, 차원 축소 기능을 결합해 일상적인 기기에서도 고품질 다국어 임베딩을 생성하도록 설계된 구글의 소형 모델이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#search-advertising
Training and Finetuning Sparse Embedding Models with Sentence Transformers
Article2024년 2월 19일

Training and Finetuning Sparse Embedding Models with Sentence Transformers

이 글은 Sentence Transformers로 희소 임베딩 모델을 미세조정하는 이유와 기본 구성요소를 설명하며, SPLADE 계열 모델의 해석 가능성·확장 방식·도메인 적응 필요성을 실용 예제로 보여준다.

huggingface.co
#ai-architecture#multimodal#llm#vision-language-models
Asynchronous Robot Inference: Decoupling Action Prediction and Execution
Article2023년 4월 23일

Asynchronous Robot Inference: Decoupling Action Prediction and Execution

로봇 정책이 미래 행동 묶음을 예측하는 동안 실행을 멈추는 문제를 줄이기 위해, 글은 행동 예측과 실행을 분리하는 비동기 추론 구조로 지연을 제거하고 더 촘촘한 제어 루프를 만드는 방법을 설명합니다.

huggingface.co
#ai-architecture#multimodal#agent-routing#llm
이전1…16171818 / 18다음