Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
OpenAI and Broadcom unveil LLM-optimized inference chip
Article2026년 6월 24일

OpenAI and Broadcom unveil LLM-optimized inference chip

OpenAI와 Broadcom은 LLM 추론에 최적화한 OpenAI의 첫 인텔리전스 프로세서 ‘Jalapeño’를 공개하며, 모델·제품·인프라까지 직접 최적화하는 풀스택 전략을 칩 단계로 확장했다.

openai.com
#broadcom#openai#privacy-design#ai-architecture
OpenAI unveils its first custom chip, built by Broadcom
Article2026년 6월 24일

OpenAI unveils its first custom chip, built by Broadcom

OpenAI는 Broadcom과 함께 만든 첫 맞춤형 추론 칩 ‘Jalapeño’를 공개하며, 추론 비용과 전력 효율을 낮추기 위한 인프라 내재화 전략을 강조했습니다.

Russell Brandom
#broadcom#nvidia#openai#ai-architecture
Qualcomm Buys Buzzy Chip Startup Modular for Nearly $4 Billion
Article2026년 6월 24일

Qualcomm Buys Buzzy Chip Startup Modular for Nearly $4 Billion

퀄컴은 여러 칩에서 AI 소프트웨어를 재작성 없이 실행하도록 돕는 플랫폼 스타트업 모듈러를 약 40억 달러에 인수하며 모바일을 넘어 데이터센터와 AI 기기 영역으로 확장하려 한다.

Lauren Goode
#anthropic#ai-architecture#capex-cycle#change-management
The emergence of the web data infrastructure layer for AI
Article2026년 6월 24일

The emergence of the web data infrastructure layer for AI

AI의 다음 병목은 모델 크기가 아니라, 최신·관련성·신뢰성을 갖춘 웹 데이터를 실시간으로 발견하고 구조화해 공급하는 인프라 계층에 있다.

technologyreview.com
#privacy-design#ai-architecture#agent-memory#context-compression
한 분이라도 더 보셨으면 좋겠습니다 (앤트로픽 풀다큐 번역)
YouTube2026년 6월 24일

한 분이라도 더 보셨으면 좋겠습니다 (앤트로픽 풀다큐 번역)

한 분이라도 더 보셨으면 좋겠습니다: 앤트로픽은 ‘안전한 AI’를 내세운 회사이지만, Claude의 급성장과 군사·사이버·노동시장 영향이 커지면서 그 약속이 실제 권력과 책임의 시험대에 올랐습니다.

비즈까페
#anthropic#ai-safety#explainer#core-thesis
Build a protein research copilot with Amazon Bedrock AgentCore
Article2026년 6월 23일

Build a protein research copilot with Amazon Bedrock AgentCore

이 글은 자연어 질의 파싱, ESM C 300M 단백질 임베딩 기반 벡터 검색, AI 요약을 결합해 대규모 펩타이드 데이터에서 구조적으로 유사한 후보를 찾는 대화형 단백질 연구 코파일럿을 구축하는 과정을 설명한다.

aws.amazon.com
#anthropic#service-design#ai-architecture#agent-deployment
Build real agentic apps using CUGA: two dozen working examples on a lightweight harness
Article2026년 6월 23일

Build real agentic apps using CUGA: two dozen working examples on a lightweight harness

CUGA는 에이전트 앱에서 반복되는 계획·실행·도구 호출·상태 관리·정책 처리를 하네스가 맡고, 개발자는 도구 목록과 프롬프트에 집중하도록 해 주는 IBM의 오픈소스 에이전트 하네스입니다.

huggingface.co
#anthropic#service-design#ai-architecture#agent-memory
Data liquidity leads to AI success
Article2026년 6월 23일

Data liquidity leads to AI success

MIT Sloan 글은 AI 성과를 좌우하는 핵심이 데이터의 양이나 모델의 정교함보다 전사적으로 데이터를 재사용·결합·활용할 수 있는 ‘데이터 유동성’이라고 설명한다.

mitsloan.mit.edu
#service-design#ai-architecture#llm#semiconductors
Four travel and hospitality trends from HITEC 2026
Article2026년 6월 23일

Four travel and hospitality trends from HITEC 2026

HITEC 2026에서 드러난 핵심은 호텔·여행업계가 AI로 이동하고 있지만, 실제 성과는 연결된 데이터, 현대적 결제 인프라, 보이지 않게 작동하는 고객 경험을 갖춘 사업자에게 집중된다는 점이다.

stripe.com
#travel-hospitality#hotel-review#ai-architecture#agent-routing
NVIDIA Brings Trusted, 24/7 AI Agents to Telecom Operations
Article2026년 6월 23일

NVIDIA Brings Trusted, 24/7 AI Agents to Telecom Operations

NVIDIA는 통신사가 과제 단위 자동화를 넘어, 합성 데이터·통신 특화 모델·보안 런타임·가속 시뮬레이션을 결합해 안전하게 운영 자율성을 확대하는 경로를 제시했습니다.

Lilac Ilan
#anthropic#nvidia#privacy-design#service-design
NVIDIA Powers Over 400 of the World’s 500 Fastest Supercomputers
Article2026년 6월 23일

NVIDIA Powers Over 400 of the World’s 500 Fastest Supercomputers

NVIDIA 기술은 최신 TOP500 슈퍼컴퓨터의 81%와 신규 진입 시스템의 약 90%를 차지하며, AI·시뮬레이션·과학을 위한 가속 컴퓨팅 인프라의 핵심 기반으로 확대되고 있다.

Chris Porter
#nvidia#ai-architecture#agent-memory#capex-cycle
The post-quantum EO is an important milestone. Now it’s time to get to work
Article2026년 6월 23일

The post-quantum EO is an important milestone. Now it’s time to get to work

미국 행정명령 14409는 연방기관과 계약업체의 양자내성암호 전환 일정을 명확히 한 중요한 이정표이며, 암호화와 인증 전환을 지금 동시에 시작해야 한다는 점을 강조한다.

@goldbe
#luxury-hospitality#luxury-travel#ai-architecture#change-management
Shared infrastructure, isolated tenants: Pool model multi-tenancy with Amazon Bedrock AgentCore
Article2026년 6월 23일

Shared infrastructure, isolated tenants: Pool model multi-tenancy with Amazon Bedrock AgentCore

이 글은 의료 AI 보조 서비스 예시를 통해 공유 인프라를 쓰면서도 테넌트·사용자·서비스 티어별 격리, 비용 추적, 권한 통제를 구현하는 멀티테넌트 AI 아키텍처 패턴을 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#agent-routing
How to Win a Space War
Article2026년 6월 22일

How to Win a Space War

이 글은 우주가 이미 전쟁 수행 영역이 되었으며, 미국이 궤도 접근권·발사 능력·위성 구조·억지력을 물리 법칙에 근거해 재설계해야 한다고 주장한다.

a16z.com
#ai-architecture#energy-security#gps-v#inflation-risk
At ISC, JUPITER Shows What Exascale Science Looks Like
Article2026년 6월 22일

At ISC, JUPITER Shows What Exascale Science Looks Like

유럽 최초의 엑사스케일 슈퍼컴퓨터 JUPITER는 뇌 지도 작성, 1km 기후 시뮬레이션, 6G용 AI, 50큐비트 양자컴퓨터 시뮬레이션을 통해 엑사스케일 과학의 실제 활용 범위를 보여준다.

Chris Porter
#nvidia#ai-architecture#multimodal#agent-memory
Building pay-per-intelligence for AI agents: How Ampersend uses Amazon Bedrock AgentCore Payments
Article2026년 6월 22일

Building pay-per-intelligence for AI agents: How Ampersend uses Amazon Bedrock AgentCore Payments

Ampersend는 Amazon Bedrock AgentCore Payments 위에 에이전트가 모델을 선택하고 요청별로 결제하며 예산 한도 안에서 작동하는 pay per intelligence 결제 라우팅 계층을 구축했다.

aws.amazon.com
#service-design#ai-architecture#agent-routing#llm
Embed the world: Multimodal AI for searchable aerial imagery at scale
Article2026년 6월 22일

Embed the world: Multimodal AI for searchable aerial imagery at scale

이 글은 Vexcel의 다중 시점 항공 이미지를 자연어로 검색 가능한 지식 기반으로 만들기 위해 멀티모달 임베딩, LLM 캡션, 벡터 검색, OpenStreetMap 기반 평가를 조합한 실험과 아키텍처를 설명한다.

aws.amazon.com
#anthropic#service-design#ai-architecture#multimodal
Hotter Than a Hot Tub: The 45°C Breakthrough to Cool AI’s Biggest Machines
Article2026년 6월 22일

Hotter Than a Hot Tub: The 45°C Breakthrough to Cool AI’s Biggest Machines

NVIDIA는 Rubin 세대 AI 인프라에서 45°C까지 동작하는 100% 액체 냉각을 통해 팬, 냉각수탑 의존, 물 소비를 크게 줄이면서 대규모 AI 데이터센터의 에너지 효율을 높이려 한다.

Josh Parker
#nvidia#ai-architecture#ai-infrastructure#capex-cycle
How we found a bug in the hyper HTTP library
Article2026년 6월 22일

How we found a bug in the hyper HTTP library

Cloudflare Images 팀은 Workers용 Images binding에서 큰 이미지 응답이 200 OK로 보이면서도 잘려 나가는 간헐적 장애를 추적해, hyper의 타이밍 의존적 race condition으로 인한 조기 socket shutdown을 찾아냈습니다.

blog.cloudflare.com
#service-design#ai-architecture#agent-deployment#agent-routing
MolmoMotion: Language-guided 3D motion forecasting
Article2026년 6월 22일

MolmoMotion: Language-guided 3D motion forecasting

몰모모션은 영상 관찰, 객체의 3차원 질의점, 행동 지시를 결합해 향후 수초간의 객체 움직임을 예측하고, 그 궤적을 로봇 계획과 제어 가능한 영상 생성에 활용하는 언어 기반 3차원 동작 예측 모델이다.

huggingface.co
#ai-architecture#llm#semiconductors#applications
NAIRR Science Program Reshapes Scientific Research, Powered by NVIDIA AI Infrastructure
Article2026년 6월 22일

NAIRR Science Program Reshapes Scientific Research, Powered by NVIDIA AI Infrastructure

미국 NSF의 NAIRR 파일럿은 NVIDIA DGX 기반 AI 인프라와 기술 지원을 통해 700개 이상의 연구 프로젝트에서 물리 시뮬레이션, 에너지 소재 탐색, 감염병 감시 같은 과학 연구의 속도와 범위를 확장하고 있다.

Zoe Kessler
#nvidia#ai-architecture#capex-cycle#search-advertising
NVIDIA Vera CPU Opens the Way for Agentic Scientific AI at Los Alamos National Laboratory
Article2026년 6월 22일

NVIDIA Vera CPU Opens the Way for Agentic Scientific AI at Los Alamos National Laboratory

로스앨러모스 국립연구소는 HPE와 NVIDIA 기반의 Mission, Vision, Veritas 슈퍼컴퓨터에 Vera CPU를 도입해 과학 시뮬레이션과 에이전트형 AI 연구를 가속하려 한다.

Chris Porter
#nvidia#ai-architecture#ai-infrastructure#capex-cycle
PP-OCRv6 on Hugging Face: 50-Language OCR from 1.5M to 34.5M Parameters
Article2026년 6월 22일

PP-OCRv6 on Hugging Face: 50-Language OCR from 1.5M to 34.5M Parameters

PP OCRv6는 1.5M~34.5M 규모의 세 가지 모델과 최대 50개 언어 지원, 여러 추론 백엔드를 결합해 실제 환경에서 정확하고 구조화된 OCR 결과를 제공하는 경량 모델 제품군이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#context-compression
Running ComfyUI workflows on Amazon SageMaker AI processing jobs
Article2026년 6월 22일

Running ComfyUI workflows on Amazon SageMaker AI processing jobs

이 글은 ComfyUI 워크플로를 Amazon SageMaker AI 처리 작업에 배포해 GPU 기반 대량 이미지 생성을 자동화하는 구조, 실행 흐름, 배포 절차를 설명합니다.

aws.amazon.com
#service-design#ai-architecture#agent-routing#prompt-library
이전1…45678…226 / 22다음