Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Building a 70-Module Convex Backend: Web, Mobile & API in One Deployment
Article2026년 1월 12일

Building a 70-Module Convex Backend: Web, Mobile & API in One Deployment

저자는 Client Commander를 하나의 Convex 백엔드로 확장하면서 웹 대시보드, 모바일 앱, 백그라운드 동기화, REST API를 같은 배포 안에서 운영할 수 있었고, 권한·타입·워크플로·검색이 플랫폼 기본 구조에 자연스럽게 붙었다고 설명한다.

stack.convex.dev
#service-design#ai-architecture#agent-deployment#agent-routing
Investing in Performance: Fine-tune small models with LLM insights - a CFM case study
Article2026년 1월 12일

Investing in Performance: Fine-tune small models with LLM insights - a CFM case study

CFM 사례는 금융 뉴스 NER에서 대형 LLM을 직접 쓰기보다 LLM으로 라벨을 만들고 검수한 뒤 소형 모델을 미세조정하면 정확도와 비용 효율을 함께 개선할 수 있음을 보여준다.

huggingface.co
#service-design#ai-architecture#multimodal#agent-deployment
Datadog uses Codex for system-level code review
Article2026년 1월 9일

Datadog uses Codex for system-level code review

Datadog은 Codex의 코드베이스 전반에 대한 추론 능력을 코드 리뷰에 적용해 기존 리뷰가 놓친 시스템 수준의 위험을 발견하고, 사고 예방과 고객 신뢰 강화를 중심으로 리뷰의 역할을 재정의했다.

openai.com
#openai#privacy-design#service-design#ai-architecture
the 2026 ai engineer roadmap
Article2026년 1월 9일

the 2026 ai engineer roadmap

2026년 AI 엔지니어에게 필요한 역량은 얇은 GPT 래퍼가 아니라, 메모리·오케스트레이션·보안·관측성을 갖춘 실제 운영형 AI 시스템을 설계하고 배포하는 능력이라는 주장입니다.

Rohit
#cursor#rohit#slack#ai-architecture
Introducing ChatGPT Health
Article2026년 1월 7일

Introducing ChatGPT Health

챗지피티 헬스는 의료 기록과 웰니스 앱을 안전하게 연결해 개인화된 건강 정보 이해를 돕되, 진단이나 치료가 아닌 의료진과의 상담을 보조하도록 설계된 전용 공간이다.

openai.com
#privacy-design#ai-architecture#llm#semiconductors
How Tolan builds voice-first AI with GPT-5.1
Article2026년 1월 7일

How Tolan builds voice-first AI with GPT-5.1

Tolan은 GPT 5.1의 낮은 지연시간과 높은 지시 이행 능력을 바탕으로, 매 턴 재구성되는 문맥과 정교한 기억·캐릭터 시스템을 결합해 자연스럽고 일관된 음성형 AI 동반자를 구현했다.

openai.com
#ai-architecture#multimodal#context-compression#prompt-library
Architectural Choices in China's Open-Source AI Ecosystem: Building Beyond DeepSeek
Article2025년 12월 23일

Architectural Choices in China's Open-Source AI Ecosystem: Building Beyond DeepSeek

중국의 오픈소스 인공지능 생태계는 딥시크 이후 최고 성능의 단일 모델보다 전문가 혼합 구조, 다중양식, 소형 모델, 허용적 라이선스, 자국산 하드웨어와 배포 도구를 결합한 지속 가능한 시스템 구축으로 경쟁의 중심을 옮기고 있다.

huggingface.co
#china#ai-architecture#multimodal#agent-deployment
Google Research 2025: Bolder breakthroughs, bigger impact
Article2025년 12월 18일

Google Research 2025: Bolder breakthroughs, bigger impact

Google Research는 2025년에 생성형 AI의 효율성·사실성·다언어성, 양자컴퓨팅, AI 기반 과학 도구, 생명과학·뇌과학, Earth AI까지 연구 성과를 제품·과학·사회적 영향으로 연결했다고 정리했다.

research.google
#muon-optimizer#privacy-design#ai-architecture#search-advertising
Tokenization in Transformers v5: Simpler, Clearer, and More Modular
Article2025년 12월 18일

Tokenization in Transformers v5: Simpler, Clearer, and More Modular

트랜스포머스 버전 5는 토크나이저의 구조와 학습된 어휘를 분리하고 내부 구성과 클래스 계층을 명확히 해, 토큰화를 더 쉽게 분석·변경·학습할 수 있도록 재설계한다.

huggingface.co
#ai-architecture#agent-routing#workflow-automation#llm
Evaluating AI’s ability to perform scientific research tasks
Article2025년 12월 16일

Evaluating AI’s ability to perform scientific research tasks

프런티어사이언스는 물리학·화학·생물학의 전문가급 문제를 통해 인공지능의 구조화된 과학 추론 능력과 실제 연구형 과제 수행 능력을 구분해 평가하고, 현재 모델의 성과와 한계를 함께 보여주는 벤치마크다.

openai.com
#ai-architecture#agent-routing#llm#semiconductors
Building Deep Research: How we Achieved State of the Art
Article2025년 12월 15일

Building Deep Research: How we Achieved State of the Art

태빌리는 단순한 에이전트 구조, 선별된 문맥, 제한된 도구, 실패 중심의 설계를 결합해 토큰 소비를 66% 줄이면서 딥리서치 벤치에서 최고 수준의 성과를 달성했다.

huggingface.co
#service-design#ai-architecture#search-advertising#zero-click-search
How we used Codex to build Sora for Android in 28 days
Article2025년 12월 12일

How we used Codex to build Sora for Android in 28 days

OpenAI 팀은 4명의 소규모 엔지니어가 Codex를 ‘새로 온 시니어 엔지니어’처럼 온보딩·지휘·검토하는 방식으로 Sora Android 앱을 28일 만에 프로토타입에서 글로벌 출시까지 완성했다고 설명한다.

openai.com
#ai-architecture#agent-routing#workflow-automation#llm
Introducing GPT-5.2
Article2025년 12월 11일

Introducing GPT-5.2

OpenAI는 GPT 5.2를 전문 지식 업무에 가장 강한 모델 시리즈로 소개하며, GPT 5.2 Thinking이 벤치마크·장문 추론·코딩·비전·도구 사용에서 이전 모델 대비 큰 성능 향상을 보였다고 설명한다.

openai.com
#service-design#token-efficiency#ai-architecture#llm
New in llama.cpp: Model Management
Article2025년 12월 11일

New in llama.cpp: Model Management

llama.cpp 서버의 라우터 모드는 재시작 없이 여러 GGUF 모델을 검색·적재·전환·해제하고, 요청의 모델 지정에 따라 독립 프로세스로 실행되는 모델에 트래픽을 전달합니다.

huggingface.co
#anthropic#ai-architecture#agent-memory#agent-routing
How Scout24 is building the next generation of real-estate search with AI
Article2025년 12월 9일

How Scout24 is building the next generation of real-estate search with AI

독일 최대 부동산 플랫폼 Scout24는 GPT 5 기반 대화형 검색 도우미 HeyImmo를 개발하면서 단순한 매물 검색을 넘어 사용자의 요구를 уточ화하고 선택을 안내하는 신뢰도 높은 부동산 전문가 경험을 구축했다.

openai.com
#openai#privacy-design#ai-architecture#ai-safety
Titans + MIRAS: Helping AI have long-term memory
Article2025년 12월 4일

Titans + MIRAS: Helping AI have long-term memory

Titans와 MIRAS는 실행 중 장기 기억을 선택적으로 갱신하는 방식으로, 매우 긴 문맥을 더 빠르고 정확하게 다루려는 새로운 시퀀스 모델링 접근이다.

research.google
#ai-architecture#agent-memory#context-compression#retrieval-index
Transformers v5: Simple model definitions powering the AI ecosystem
Article2025년 12월 1일

Transformers v5: Simple model definitions powering the AI ecosystem

Transformers v5는 폭발적으로 커진 AI 생태계의 기준 모델 정의 라이브러리로 남기 위해 단순성, 훈련, 추론, 프로덕션 연동, 양자화를 중심으로 구조를 재정비한 릴리스다.

huggingface.co
#ai-architecture#multimodal#agent-deployment#agent-routing
Real-time speech-to-speech translation
Article2025년 11월 19일

Real-time speech-to-speech translation

구글 딥마인드와 구글 코어 ML은 원 화자의 목소리를 유지하면서 약 2초 지연으로 실시간 음성 음성 번역을 수행하는 엔드투엔드 S2ST 모델과 이를 위한 시간 동기화 데이터 파이프라인을 소개했다.

research.google
#privacy-design#ai-architecture#agent-routing#workflow-automation
Understanding neural networks through sparse circuits
Article2025년 11월 13일

Understanding neural networks through sparse circuits

OpenAI는 대부분의 가중치를 0으로 제한한 희소 신경망을 훈련해, 일부 단순 행동이 작고 분리된 회로로 구현되며 해당 회로를 사람이 추적할 수 있음을 보였다.

openai.com
#openai#privacy-design#ai-architecture#mlp
Introducing Nested Learning: A new ML paradigm for continual learning
Article2025년 11월 7일

Introducing Nested Learning: A new ML paradigm for continual learning

구글 리서치는 모델 구조와 최적화 규칙을 하나의 중첩된 학습 시스템으로 보는 Nested Learning을 제안하며, 지속 학습의 핵심 난제인 파국적 망각을 줄이는 새 설계 관점을 제시했다.

research.google
#privacy-design#ai-architecture#agent-memory#agent-routing
How Hugging Face Scaled Secrets Management for AI Infrastructure
Article2025년 11월 5일

How Hugging Face Scaled Secrets Management for AI Infrastructure

허깅페이스는 멀티클라우드·쿠버네티스·로컬 개발·CI/CD에 흩어진 비밀정보 관리를 Infisical로 통합해 접근 통제와 감사·동기화를 표준화하면서도 대규모 운영에 필요한 수동 배포 통제권을 유지했다.

huggingface.co
#ai-architecture#agent-deployment#agent-routing#change-management
Exploring a space-based, scalable AI infrastructure system design
Article2025년 11월 4일

Exploring a space-based, scalable AI infrastructure system design

Project Suncatcher는 태양광 위성 군집에 Google TPU와 자유공간 광통신 링크를 탑재해 우주에서 대규모 머신러닝 연산 인프라를 확장할 수 있는지를 검토하는 Google의 연구 문샷이다.

research.google
#muon-optimizer#privacy-design#ai-architecture#ai-infrastructure
Apriel-H1: The Surprising Key to Distilling Efficient Reasoning Models
Article2025년 11월 3일

Apriel-H1: The Surprising Key to Distilling Efficient Reasoning Models

Apriel H1은 기존 150억 매개변수 추론 모델의 주의층을 단계적으로 맘바층으로 교체하면서, 일반 사전학습 데이터가 아니라 교사가 생성한 고품질 추론 궤적을 증류해 추론 품질을 거의 유지하고 처리량을 최대 2.1배 높인 하이브리드 모델이다.

huggingface.co
#linear-attention#luxury-hospitality#luxury-travel#ai-architecture
Introducing IndQA
Article2025년 11월 3일

Introducing IndQA

인디큐에이는 인도의 언어와 문화, 일상에 관한 지식과 추론 능력을 전문가 기준으로 평가하기 위해 개발된 문화 맥락 중심의 인공지능 벤치마크다.

openai.com
#openai#privacy-design#ai-architecture#llm
이전1…1516171819…2217 / 22다음