Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Building a case for catalytic climate finance
Article2026년 5월 19일

Building a case for catalytic climate finance

MIT Sloan의 Catalytic Climate Finance Project는 초기 기후기술이 시장 경쟁력을 갖추기 전 자금 공백을 넘도록 촉매적 자본 구조를 설계하려는 프로젝트다.

mitsloan.mit.edu
#anthropic#ai-architecture#semiconductors#applications
Introducing the Ettin Reranker Family
Article2026년 5월 19일

Introducing the Ettin Reranker Family

Ettin Reranker는 1,760만~10억 매개변수의 여섯 가지 교차 인코더로, 검색 속도와 재정렬 품질 사이에서 선택 가능한 장문 지원 모델군이다.

huggingface.co
#service-design#ai-architecture#llm#ai-coding
OlmoEarth v1.1: A more efficient family of Earth observation models
Article2026년 5월 19일

OlmoEarth v1.1: A more efficient family of Earth observation models

OlmoEarth v1.1은 위성영상 토큰의 해상도별 분리를 통합하고 사전학습 방식을 조정해 기존 성능을 대체로 유지하면서 연산 비용을 최대 3분의 1로 줄인 지구관측 모델 제품군이다.

huggingface.co
#ai-architecture#llm#semiconductors#applications
Shipping a Trillion Parameters With a Hub Bucket: Delta Weight Sync in TRL
Article2026년 5월 19일

Shipping a Trillion Parameters With a Hub Bucket: Delta Weight Sync in TRL

TRL의 델타 가중치 동기화는 연속된 강화학습 단계에서 실제로 바뀐 극소수의 bf16 원소만 희소 세이프텐서로 저장해 허깅페이스 버킷으로 전달함으로써, 대규모 모델의 반복적인 전체 체크포인트 전송 비용과 추론 중단 시간을 크게 줄이는 방식이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#context-compression
Learn the Hugging Face Kernel Hub in 5 Minutes
Article2026년 5월 18일

Learn the Hugging Face Kernel Hub in 5 Minutes

허깅페이스 커널 허브는 파이썬·파이토치·쿠다 환경에 맞는 사전 최적화 연산 커널을 허브에서 내려받아, 복잡한 로컬 빌드 없이 모델의 특정 연산에 적용하도록 돕는 체계다.

huggingface.co
#ai-architecture#agent-routing#llm#applications
Project Glasswing: what Mythos showed us
Article2026년 5월 18일

Project Glasswing: what Mythos showed us

Cloudflare는 Project Glasswing에서 Mythos Preview를 자사 저장소 50여 개에 적용하며, 보안 특화 LLM이 취약점 발견을 넘어 exploit chain과 실행 가능한 증명까지 만들 수 있지만 대규모 활용에는 정교한 harness와 검증 구조가 필요하다고 설명한다.

@GrantBourzikas
#anthropic#ai-architecture#agent-memory#agent-routing
Fragments: May 14
Article2026년 5월 14일

Fragments: May 14

이 글은 에이전트형 프로그래밍의 부상 속에서 레거시 현대화, 금융권 규제 복잡성, 주니어 개발자 교육, 인간의 학습, 도구 설계, AI의 위험을 둘러싼 여러 단상과 논점을 엮어 정리한다.

미상
#gnu-cobol#martin-fowler#mechanical-orchard#the-orchard-retreat
Building Blocks for Foundation Model Training and Inference on AWS
Article2026년 5월 14일

Building Blocks for Foundation Model Training and Inference on AWS

이 글은 파운데이션 모델의 확장이 사전학습 중심에서 사후학습·추론 시점 연산까지 넓어지면서, AWS 위에서 가속 컴퓨트·저지연 네트워크·분산 스토리지·오픈소스 운영 스택이 어떻게 함께 설계되어야 하는지 설명한다.

huggingface.co
#amazon-ec2#ec2-p5#ec2-p6#nvidia-h100
AI 기업들이 대놓고 팔란티어를 베끼기 시작한 충격적인 이유
YouTube2026년 5월 14일

AI 기업들이 대놓고 팔란티어를 베끼기 시작한 충격적인 이유

OpenAI와 Anthropic은 단순히 더 좋은 모델을 파는 단계를 넘어, 팔란티어식 FDE 전략처럼 기업 현장에 들어가 업무를 재설계하고 AI 워크플로우를 제품화하려는 방향으로 움직이고 있다는 것이 영상의 핵심 주장입니다.

묘수의 관점
#energy-infrastructure#ai-safety#anthropic#cayc
Building a safe, effective sandbox to enable Codex on Windows
Article2026년 5월 13일

Building a safe, effective sandbox to enable Codex on Windows

OpenAI는 Windows에서 Codex가 개발자 생산성을 유지하면서도 파일 쓰기와 네트워크 접근을 안전하게 제한할 수 있도록 자체 샌드박스 설계를 모색했고, 기존 Windows 격리 도구와 첫 비상승권한 프로토타입의 한계를 분석했다.

openai.com
#openai#privacy-design#ai-architecture#agent-routing
Hermes Agent Masterclass
Article2026년 5월 13일

Hermes Agent Masterclass

Hermes Agent는 세션이 끝나도 사용자 맥락과 작업 절차를 축적하도록 설계된 오픈소스 AI 에이전트로, 정체성 설정, 3단계 메모리, 자가 진화형 스킬, Curator, GEPA 최적화를 결합해 장기적으로 개인 워크플로에 맞춰지는 구조를 지향한다.

Akshay 🚀
#hermes-agent#memory-md#soul-md#user-md
Researchers Worldwide Compete to Shape the Future of AI in Organizations
Article2026년 5월 12일

Researchers Worldwide Compete to Shape the Future of AI in Organizations

스탠퍼드 HAI와 Google DeepMind는 조직 내 AI 활용이 팀워크와 협업을 어떻게 바꿀지 연구하기 위해 국제 공모전을 열었고, 우승팀은 성공적인 조정 과정을 학습하는 ‘대규모 조정 모델’을 제안했다.

hai.stanford.edu
#ai-architecture#multimodal#search-advertising#zero-click-search
What Parameter Golf taught us
Article2026년 5월 12일

What Parameter Golf taught us

OpenAI의 Parameter Golf는 16MB·10분 학습 예산이라는 강한 제약 속에서 1,000명 이상이 2,000건 넘는 제출을 만든 공개 머신러닝 도전으로, 기술적 창의성과 AI 코딩 에이전트가 연구 경쟁의 방식과 검토 부담을 어떻게 바꾸는지 보여주었다.

openai.com
#openai#muon-optimizer#privacy-design#ai-architecture
Why Convex doesn't let candidates use AI in coding interviews
Article2026년 5월 11일

Why Convex doesn't let candidates use AI in coding interviews

Convex는 AI를 부정해서가 아니라 코딩 인터뷰가 지원자의 사고·소통·판단을 읽는 제한된 장치이기 때문에 AI를 배제하고, 실제 업무에서는 산출물 품질에 책임지는 한 도구 사용을 강제도 금지도 하지 않는다.

stack.convex.dev
#ai-architecture#agent-routing#llm#semiconductors
How to Master Context Engineering & Build AI Systems That Actually Understand You (Full Course)
Article2026년 5월 10일

How to Master Context Engineering & Build AI Systems That Actually Understand You (Full Course)

AI 성과를 높이는 핵심은 더 멋진 프롬프트 문장이 아니라, 모델이 참고할 정보·기억·도구·규칙을 설계하는 “컨텍스트 엔지니어링”이라는 주장입니다.

Khairallah AL-Awady
#obsidian#context-files#identity-file#vector-database
Seedance Makes A Splash, Nvidia's AI-Guided Chip Designs, Helping Robots Not Forget
Article2026년 5월 8일

Seedance Makes A Splash, Nvidia's AI-Guided Chip Designs, Helping Robots Not Forget

본문은 AI 대량실업론에 대한 반박으로 시작해 ByteDance의 Seedance 2.0 확산과 Nvidia의 AI 기반 칩 설계 활용 사례를 다룬다.

deeplearning.ai
#nvidia#privacy-design#service-design#ai-architecture
Inside Porsche Cup Brasil’s AI-powered race operations
Article2026년 5월 7일

Inside Porsche Cup Brasil’s AI-powered race operations

포르쉐 컵 브라질은 Microsoft 기반 AI 손상 분석과 실시간 텔레메트리를 활용해 사고 차량 진단, 수리 의사결정, 경기 운영을 더 빠르고 일관된 실시간 시스템으로 바꾸고 있다.

news.microsoft.com
#privacy-design#service-design#ai-architecture#agent-routing
Notes from inside China's AI labs - by Nathan Lambert
Article2026년 5월 7일

Notes from inside China's AI labs - by Nathan Lambert

중국의 주요 AI 연구소들은 미국과 비슷한 기술 재료를 갖췄지만, 학생 중심 인력 구조와 낮은 개인주의적 경쟁, 실용적 실행 문화 덕분에 LLM ‘빠른 추격자’로 강하게 기능하고 있다는 현장 관찰이다.

interconnects.ai
#anthropic#china#hotel-review#privacy-design
Uber uses OpenAI to help people earn smarter and book faster
Article2026년 5월 6일

Uber uses OpenAI to help people earn smarter and book faster

우버는 OpenAI 모델과 Realtime API를 활용해 운전자에게 실시간 수익 기회를 더 쉽게 안내하고, 승객에게는 자연어 음성 기반 예약 경험을 제공하려 하고 있다.

openai.com
#openai#privacy-design#ai-architecture#agent-routing
Top Companies Are Secretly Working on This (It Will Replace LLMs)
Article2026년 5월 5일

Top Companies Are Secretly Working on This (It Will Replace LLMs)

SSM은 긴 컨텍스트에서 Transformer의 비용·메모리 병목을 줄이기 위한 대안적 시퀀스 처리 구조로, 특히 장기 작업을 수행하는 에이전트 시스템에서 주목받고 있다는 것이 원문의 핵심 주장입니다.

Siddharth
#hyena#mamba#mamba-2#state-space-model
Granite Embedding Multilingual R2: Open Apache 2.0 Multilingual Embeddings with 32K Context — Best Sub-100M Retrieval Quality
Article2026년 5월 4일

Granite Embedding Multilingual R2: Open Apache 2.0 Multilingual Embeddings with 32K Context — Best Sub-100M Retrieval Quality

IBM의 Granite Embedding Multilingual R2는 200개 이상의 언어와 32K 토큰 문맥을 지원하며, 97M 소형 모델과 311M 고성능 모델로 다국어·장문·코드 검색의 성능과 배포 효율을 함께 높인 Apache 2.0 임베딩 모델군이다.

huggingface.co
#ai-architecture#multimodal#agent-memory#retrieval-index
How OpenAI delivers low-latency voice AI at scale
Article2026년 5월 4일

How OpenAI delivers low-latency voice AI at scale

OpenAI는 대규모 음성 AI에서 대화 지연을 줄이기 위해 WebRTC 기반 실시간 미디어 처리를 Kubernetes 환경에 맞게 재설계하고, 릴레이와 트랜시버를 분리한 구조를 설명한다.

openai.com
#openai#privacy-design#service-design#ai-architecture
Who Owns the First 1 Meter?
Article2026년 5월 3일

Who Owns the First 1 Meter?

AI 데이터센터의 병목은 GPU 자체를 넘어, 1MW 랙에 전력과 냉각을 실제로 연결하는 “첫 1미터” 물리 인프라로 이동하고 있다.

Nutty
#800vdc#microsoft#1mw-rack#amy-hood
Catalyzing scientific impact through global partnerships and open resources
Article2026년 5월 1일

Catalyzing scientific impact through global partnerships and open resources

Google Research Science 팀은 책임 있고 포용적인 개방 과학 원칙 아래 오픈소스 도구, 공개 데이터셋, 글로벌 파트너십을 통해 유전체학·뇌과학·기후·보건·생물다양성 분야의 실제 연구 성과와 사회적 영향을 확장하고 있다고 설명한다.

research.google
#ai-architecture#multimodal#agent-routing#search-advertising
이전1…1011121314…2212 / 22다음