Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#gpu
Tag79건Article 79

#gpu

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#nvidia공동문서 57 · 연관도 30%#capex-cycle공동문서 42 · 연관도 29%#applications공동문서 79 · 연관도 27%#ai-architecture공동문서 48 · 연관도 24%#llm공동문서 77 · 연관도 24%#agent-routing공동문서 32 · 연관도 15%#service-design공동문서 24 · 연관도 14%#retrieval-index공동문서 19 · 연관도 13%#ai-infrastructure공동문서 20 · 연관도 13%#agent-memory공동문서 27 · 연관도 13%
Launching UI for generative AI inference recommendations in Amazon SageMaker AI
Article2026년 7월 13일

Launching UI for generative AI inference recommendations in Amazon SageMaker AI

아마존 세이지메이커 AI 스튜디오의 새 추론 추천 사용자 인터페이스는 생성형 인공지능 모델의 워크로드 설정부터 실제 장비 벤치마크, 결과 비교, 운영 엔드포인트 배포까지를 코드 없이 연결합니다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#agent-routing
Fine-tune NVIDIA Nemotron 3 models with Amazon SageMaker AI serverless model customization
Article2026년 7월 10일

Fine-tune NVIDIA Nemotron 3 models with Amazon SageMaker AI serverless model customization

Amazon SageMaker AI의 서버리스 모델 맞춤화를 이용하면 인프라를 직접 관리하지 않고도 NVIDIA Nemotron 3 Nano와 Super를 SFT, RLVR, RLAIF 방식으로 기업 데이터와 업무에 특화할 수 있다.

aws.amazon.com
#nvidia#service-design#ai-architecture#capex-cycle
Can AI answer the $3 trillion question?
Article2026년 7월 9일

Can AI answer the $3 trillion question?

AI 인프라에 투입된 막대한 자본을 정당화하려면 업계가 3조 달러를 벌어야 하지만, 저가 모델 확산과 토큰 가격 하락이 투자금 회수와 거시경제의 위험 요인으로 떠오르고 있다.

Tim Fernholz
#anthropic#nvidia#token-efficiency#agent-memory
The Mind’s New Dial: Neural Wearables and the $12 Billion Cognitive Gold Rush...
Article2026년 7월 9일

The Mind’s New Dial: Neural Wearables and the $12 Billion Cognitive Gold Rush...

이 글은 비침습 신경 웨어러블이 뇌를 실시간으로 측정·해석·피드백하는 ‘프로그래밍 가능한 인터페이스’로 바꾸며, 기존 카페인·명상 앱·약물 중심의 둔탁한 인지 관리 시장을 정밀 기술과 소재 공급망 중심의 투자 영역으로 재편하고 있다고 설명한다.

C.D. Lawrence
#privacy-design#ai-architecture#agent-routing#llm
Trends in Artificial Intelligence
Article2026년 7월 8일

Trends in Artificial Intelligence

Epoch AI의 대시보드는 AI 발전이 추론 비용 하락, 훈련 컴퓨트 확대, 소프트웨어 효율 개선, AI 칩·데이터센터 확장, 투자 증가가 함께 맞물리며 빠르게 진행되고 있음을 보여준다.

epoch.ai
#agent-memory#ai-safety#context-compression#retrieval-index
Hot French startup ZML releases free product to speed inference across lots of AI chips
Article2026년 7월 8일

Hot French startup ZML releases free product to speed inference across lots of AI chips

프랑스 AI 스타트업 ZML이 여러 종류의 AI 칩에서 오픈소스 대형언어모델 추론을 더 빠르고 유연하게 실행하도록 돕는 무료 제품 ZML/LLMD를 출시했다.

Anna Heim
#nvidia#ai-architecture#ai-infrastructure#capex-cycle
AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters
Article2026년 7월 7일

AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters

엔비디아는 에이전트형 AI 시대에는 GPU만큼이나 에이전트 루프를 빠르게 진전시키는 대규모 단일 스레드 성능 중심 CPU가 중요하며, Vera가 그 요구에 맞춘 CPU라고 설명한다.

Ian Buck
#nvidia#ai-architecture#agent-memory#agent-routing
How Nations Are Deploying AI for Strategic Priorities
Article2026년 7월 6일

How Nations Are Deploying AI for Strategic Priorities

각국은 국내 인프라, 지역 데이터, 자국 인재를 바탕으로 AI 모델과 애플리케이션을 구축해 경제, 공공서비스, 문화, 보안, 지속가능성 같은 전략 목표에 맞춘 역량을 키우고 있다.

Calista Redmond
#anthropic#service-design#agent-deployment#agent-routing
How Open Models Are Driving AI Research
Article2026년 7월 6일

How Open Models Are Driving AI Research

ICML 2026 논문 흐름은 공개 프런티어 모델과 공개 AI 인프라가 현대 AI 연구의 핵심 기반으로 자리 잡았음을 보여준다.

JJ Kim
#nvidia#ai-architecture#agent-routing#capex-cycle
AI Data Centers
Article2026년 7월 5일

AI Data Centers

Epoch AI의 AI Data Centers Hub는 위성 이미지, 허가 문서, 공개 자료를 바탕으로 전 세계 주요 AI 데이터센터 60곳의 전력, 연산, 비용, 건설 일정을 추정·검증한 공개 데이터베이스입니다.

epoch.ai
#anthropic#ai-safety#llm#applications
The only AI glossary you'll need this year
Article2026년 7월 3일

The only AI glossary you'll need this year

이 글은 인공지능 분야에서 자주 쓰이는 핵심 용어를 비전문가도 이해할 수 있도록 AGI, AI 에이전트, 추론, LLM, 환각, 미세조정 등 주요 개념별로 풀어 설명한 실용적 용어집이다.

Natasha Lomas, Romain Dillet, Kyle Wiggers, Lucas Ropek
#anthropic#privacy-design#service-design#ai-architecture
NVIDIA Unlocks AI Compute at Scale, Inviting Partners to Power the AI Infrastructure Buildout
Article2026년 7월 2일

NVIDIA Unlocks AI Compute at Scale, Inviting Partners to Power the AI Infrastructure Buildout

엔비디아는 AI가 개발 단계를 넘어 대규모 추론 운영으로 이동하면서, AI 클라우드 사업자와 수익 공유·신용 지원 모델을 통해 NVIDIA 기반 AI 팩토리 구축과 컴퓨트 접근성을 확대하겠다고 밝혔다.

Colette Kress, Raj Mirpuri
#nvidia#ai-infrastructure#capex-cycle#llm
How NVIDIA’s Inference Software Stack Powers the Lowest Token Cost
Article2026년 6월 30일

How NVIDIA’s Inference Software Stack Powers the Lowest Token Cost

NVIDIA는 하드웨어와 공동 설계된 다층 추론 소프트웨어 및 오픈소스 생태계의 최적화를 결합해 처리량을 높이고 토큰당 비용을 지속적으로 낮춘다고 설명한다.

Amr Elmeleegy
#nvidia#service-design#ai-architecture#agent-routing
How Outpost VFX Uses AWS to Accelerate AI Model Training for Visual Effects
Article2026년 6월 30일

How Outpost VFX Uses AWS to Accelerate AI Model Training for Visual Effects

Outpost VFX는 AWS EC2 P5 기반의 다중 GPU 분산 학습으로 얼굴 교체 모델 학습 병목을 줄여 최대 8배 빠른 반복 속도와 2일 내 초기 납품 흐름을 확보했다.

aws.amazon.com
#ai-architecture#agent-routing#ai-infrastructure#capex-cycle
Claude Meets Blackwell Ultra: Anthropic’s Models Now Run on NVIDIA GB300 in Azure
Article2026년 6월 29일

Claude Meets Blackwell Ultra: Anthropic’s Models Now Run on NVIDIA GB300 in Azure

Anthropic의 Claude 모델이 Microsoft Foundry에서 NVIDIA GB300 블랙웰 울트라 기반으로 일반 제공되며, Azure 중심 기업이 자율형·도메인 특화 AI 에이전트를 구축할 수 있는 새 기반을 얻었다.

Dave Salvator
#anthropic#nvidia#agent-deployment#agent-routing
Firefly Aerospace Operates NVIDIA Jetson in Lunar Orbit for the First Time
Article2026년 6월 29일

Firefly Aerospace Operates NVIDIA Jetson in Lunar Orbit for the First Time

파이어플라이 에어로스페이스는 블루 고스트 미션 2에서 엔비디아 젯슨 기반의 오큘라 서비스를 가동해, 달 궤도에서 영상 데이터를 직접 분석하고 필요한 정보만 지구로 전송할 계획이다.

Chen Su
#nvidia#service-design#ai-infrastructure#capex-cycle
Run a vLLM Server on HF Jobs in One Command
Article2026년 6월 26일

Run a vLLM Server on HF Jobs in One Command

Hugging Face Jobs에서 vLLM OpenAI 호환 서버를 한 줄 명령으로 띄우고, 토큰 인증으로 호출하며, 필요에 따라 대형 모델·Gradio UI·SSH 디버깅·코딩 에이전트 백엔드까지 확장하는 방법을 설명한다.

huggingface.co
#service-design#ai-architecture#ai-infrastructure#capex-cycle
Databricks’ former AI chief thinks he can cut AI’s power bill by 1,000x
Article2026년 6월 25일

Databricks’ former AI chief thinks he can cut AI’s power bill by 1,000x

Databricks 전 AI 책임자 Naveen Rao가 이끄는 Unconventional AI는 오실레이터 기반 컴퓨팅으로 AI 추론 전력 사용을 최대 1,000분의 1로 줄이겠다는 목표를 제시했다.

Russell Brandom
#ai-architecture#capex-cycle#llm#applications
Optimize model training on Amazon SageMaker AI with NVIDIA Blackwell
Article2026년 6월 25일

Optimize model training on Amazon SageMaker AI with NVIDIA Blackwell

이 글은 Amazon SageMaker AI의 P6 B200 인스턴스와 NVIDIA Blackwell GPU를 활용해 대규모 모델 학습에서 배치 크기, 시퀀스 길이, 샤딩, 정밀도 형식, 활성화 체크포인팅을 어떻게 조정해야 하는지 설명한다.

aws.amazon.com
#nvidia#service-design#ai-architecture#agent-memory
I Met With China’s Top AI Experts. They’re Freaking Out, Too
Article2026년 6월 24일

I Met With China’s Top AI Experts. They’re Freaking Out, Too

베이징 AI 회의에서 드러난 핵심 메시지는 미국과 중국이 치열한 AI 경쟁을 계속하더라도, 프런티어 AI의 사이버보안·시스템 위험을 줄이기 위해 협력해야 한다는 것이다.

Will Knight
#anthropic#china#capex-cycle#llm
How Businesses Are Building Specialized AI They Can Trust
Article2026년 6월 23일

How Businesses Are Building Specialized AI They Can Trust

기업 AI는 단순한 모델 접근과 실험을 넘어, 실제 업무 흐름에 맞게 조정·통제할 수 있는 전문화된 에이전트 기반으로 이동하고 있다.

Justin Boitano
#nvidia#agent-routing#ai-infrastructure#capex-cycle
NVIDIA Brings Trusted, 24/7 AI Agents to Telecom Operations
Article2026년 6월 23일

NVIDIA Brings Trusted, 24/7 AI Agents to Telecom Operations

NVIDIA는 통신사가 과제 단위 자동화를 넘어, 합성 데이터·통신 특화 모델·보안 런타임·가속 시뮬레이션을 결합해 안전하게 운영 자율성을 확대하는 경로를 제시했습니다.

Lilac Ilan
#anthropic#nvidia#privacy-design#service-design
NVIDIA Powers Over 400 of the World’s 500 Fastest Supercomputers
Article2026년 6월 23일

NVIDIA Powers Over 400 of the World’s 500 Fastest Supercomputers

NVIDIA 기술은 최신 TOP500 슈퍼컴퓨터의 81%와 신규 진입 시스템의 약 90%를 차지하며, AI·시뮬레이션·과학을 위한 가속 컴퓨팅 인프라의 핵심 기반으로 확대되고 있다.

Chris Porter
#nvidia#ai-architecture#agent-memory#capex-cycle
GLM-5.2 is the step change for open agents
Article2026년 6월 22일

GLM-5.2 is the step change for open agents

글은 GLM 5.2가 오픈 웨이트 모델이 코딩 하네스 안에서 범용 에이전트로 신뢰할 만한 단계에 처음 도달했음을 보여 주는 전환점이라고 평가한다.

Nathan Lambert
#anthropic#privacy-design#agent-routing#capex-cycle
이전12341 / 4다음