Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-routing
Tag552건YouTube 1Article 551

#agent-routing

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 522 · 연관도 61%#applications공동문서 464 · 연관도 59%#semiconductors공동문서 483 · 연관도 59%#workflow-automation공동문서 142 · 연관도 49%#ai-architecture공동문서 190 · 연관도 37%#agent-memory공동문서 206 · 연관도 37%#privacy-design공동문서 163 · 연관도 33%#service-design공동문서 137 · 연관도 31%#retrieval-index공동문서 107 · 연관도 28%#agent-deployment공동문서 122 · 연관도 28%
Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training
Article2025년 8월 12일

Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training

Accelerate와 Axolotl은 데이터·완전 샤딩 데이터·텐서·컨텍스트 병렬화를 조합해 대규모 모델의 메모리 사용량, 계산량, 장치 간 통신 비용을 균형 있게 설계하도록 지원한다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#capex-cycle
Basis scales accounting by turning OpenAI model progress into trusted agents
Article2025년 8월 12일

Basis scales accounting by turning OpenAI model progress into trusted agents

베이시스는 업무별로 적합한 오픈AI 모델을 배치하고 판단 근거를 검토 가능하게 공개함으로써, 회계 자동화를 신뢰할 수 있는 업무 위임 체계로 확장하고 있다.

openai.com
#openai#ai-architecture#agent-routing#workflow-automation
Enabling physician-centered oversight for AMIE
Article2025년 8월 12일

Enabling physician-centered oversight for AMIE

g AMIE는 환자 문진과 의료 기록 초안을 맡되 개별화된 의학적 조언은 금지하고, 최종 판단과 환자 전달은 감독 의사가 검토·수정하도록 설계된 AMIE의 의사 중심 감독 연구 프레임워크다.

research.google
#agent-routing#llm#semiconductors#applications
gpt-oss-120b & gpt-oss-20b Model Card
Article2025년 8월 5일

gpt-oss-120b & gpt-oss-20b Model Card

OpenAI는 gpt oss 120b와 gpt oss 20b를 공개 가중치 추론 모델로 소개하며, 에이전트형 워크플로와 도구 사용을 지원하되 공개 모델 특유의 안전 위험과 평가 결과를 함께 제시했다.

openai.com
#openai#privacy-design#agent-deployment#agent-routing
Introducing gpt-oss
Article2025년 8월 5일

Introducing gpt-oss

오픈AI는 높은 추론·도구 사용 성능과 효율적인 로컬 실행을 결합한 아파치 2.0 기반 오픈 웨이트 모델 gpt oss 120b와 gpt oss 20b를 공개했다.

openai.com
#ai-architecture#multimodal#agent-memory#agent-routing
How hard is it to migrate AWAY from Convex?
Article2025년 8월 4일

How hard is it to migrate AWAY from Convex?

저자는 Convex에서 벗어나는 난이도를 직접 검증하기 위해 간단한 Tanstack Start 예제를 기준으로 함수, 클라이언트 호출, 반응형 쿼리, 데이터베이스 이전을 차례로 Tanstack Start와 Drizzle/Postgres로 옮겨 보며 실제 작업량과 복잡도 변화를 살펴본다.

stack.convex.dev
#service-design#ai-architecture#agent-memory#agent-routing
Lessons from Building an AI App Builder on Convex
Article2025년 7월 31일

Lessons from Building an AI App Builder on Convex

Chef의 사례는 AI 코딩 에이전트가 잘 작동하려면 좋은 추상화, 제한된 선택지, 타입 안전한 피드백 루프, 검증 가능한 평가 체계가 필요하다는 점을 보여준다.

stack.convex.dev
#ai-architecture#agent-routing#context-compression#prompt-library
Intercom's three lessons for creating a sustainable AI advantage
Article2025년 7월 30일

Intercom's three lessons for creating a sustainable AI advantage

인터콤은 조기 실험으로 모델 이해도를 높이고, 엄격한 평가로 도입 속도를 끌어올리며, 모델 교체가 쉬운 유연한 아키텍처를 구축해 지속 가능한 인공지능 경쟁력을 만들었다.

openai.com
#openai#privacy-design#service-design#ai-architecture
Introducing Trackio: A Lightweight Experiment Tracking Library from Hugging Face
Article2025년 7월 29일

Introducing Trackio: A Lightweight Experiment Tracking Library from Hugging Face

트래키오는 로컬 대시보드, 허깅페이스 스페이스 공유, 기존 wandb 호환 API를 결합한 무료 오픈소스 실험 추적 파이썬 라이브러리다.

huggingface.co
#nvidia#agent-routing#ai-infrastructure#capex-cycle
Prefill and Decode for Concurrent Requests - Optimizing LLM Performance
Article2025년 7월 28일

Prefill and Decode for Concurrent Requests - Optimizing LLM Performance

동시 요청을 처리하는 LLM 추론에서는 프리필과 디코드의 계산 특성이 달라, 첫 토큰 지연·토큰 생성 지연·총처리량·GPU 활용률 사이의 균형에 맞춰 배칭과 프리필 청크 크기를 조정해야 한다.

huggingface.co
#agent-memory#agent-routing#retrieval-index#workflow-automation
Codex is Open Sourcing AI models
Article2025년 7월 26일

Codex is Open Sourcing AI models

이 글은 Codex가 Hugging Face Skills를 활용해 데이터 검증, 모델 파인튜닝, 학습 모니터링, 평가, 보고서 갱신, Hub 배포까지 이어지는 오픈소스 모델 실험을 수행하는 방법을 설명한다.

huggingface.co
#agent-deployment#agent-routing#ai-safety#llm
Ulysses Sequence Parallelism: Training with Million-Token Contexts
Article2025년 7월 26일

Ulysses Sequence Parallelism: Training with Million-Token Contexts

Ulysses Sequence Parallelism은 긴 시퀀스 학습에서 시퀀스와 어텐션 헤드를 함께 나누고 all to all 통신으로 재배치해, 단일 GPU 메모리 한계를 넘어 수십만~백만 토큰 문맥 학습을 가능하게 하는 방식이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#retrieval-index
Model ML is helping financial firms rebuild with AI from the ground up
Article2025년 7월 23일

Model ML is helping financial firms rebuild with AI from the ground up

Model ML은 금융 업무에 특화된 AI 에이전트와 애플리케이션으로 리서치, 분석, 발표자료 작성 같은 복잡한 워크플로를 자동화하며 금융사의 운영 구조 자체를 AI 중심으로 재편하고 있다.

openai.com
#service-design#ai-architecture#multimodal#agent-routing
Pioneering an AI clinical copilot with Penda Health
Article2025년 7월 22일

Pioneering an AI clinical copilot with Penda Health

펜다 헬스가 진료 흐름에 통합한 임상 보조 도구 에이아이 컨설트는 의료진의 통제권을 유지하면서 잠재적 오류를 경고해 진단 오류를 16%, 치료 오류를 13% 상대적으로 줄였다.

openai.com
#agent-deployment#agent-routing#llm#semiconductors
Consilium: When Multiple LLMs Collaborate
Article2025년 7월 19일

Consilium: When Multiple LLMs Collaborate

Consilium은 서로 다른 역할을 맡은 여러 언어 모델이 구조화된 토론과 외부 조사를 거쳐 합의 또는 최종 분석을 도출하도록 만든 시각적 다중 모델 협업 플랫폼이다.

huggingface.co
#ai-architecture#agent-routing#llm#semiconductors
Invideo AI enables anyone with an idea to produce high-quality videos
Article2025년 7월 17일

Invideo AI enables anyone with an idea to produce high-quality videos

인비디오 AI는 GPT‑4.1, gpt image 1, 텍스트 음성 변환 모델을 조율해 아이디어만으로 전문 품질의 영상을 빠르게 만들고 편집하게 하는 서비스다.

openai.com
#agent-routing#context-compression#prompt-library#search-advertising
The AI tools for Art Newsletter - Issue 1
Article2025년 7월 16일

The AI tools for Art Newsletter - Issue 1

2024년 창작 AI는 오픈소스 이미지 생성의 구조적 도약과 개인화 기술의 대중화를 이뤘으며, 2025년에는 비디오·오디오·3D 등 더 다양한 형식으로 발전의 중심이 이동하고 있다.

huggingface.co
#ai-architecture#multimodal#agent-memory#agent-routing
Custom Kernels for All from Codex and Claude
Article2025년 7월 16일

Custom Kernels for All from Codex and Claude

CUDA 커널 개발 지식을 에이전트 스킬로 구조화해 Claude와 Codex가 실제 diffusers·transformers 대상의 커널, PyTorch 바인딩, 빌드 구성, 벤치마크까지 완성하도록 한 사례다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#context-compression
Migrating the Hub from Git LFS to Xet
Article2025년 7월 15일

Migrating the Hub from Git LFS to Xet

허깅페이스는 기존 사용자의 작업 방식을 유지하는 브리지와 무중단 백그라운드 마이그레이션을 기반으로, 50만 개 저장소와 20페타바이트 규모의 허브를 깃 대용량 파일 저장소에서 젯으로 전환하고 있다.

huggingface.co
#agent-routing#llm#semiconductors#applications
Efficient MultiModal Data Pipeline
Article2025년 7월 14일

Efficient MultiModal Data Pipeline

멀티모달 학습의 GPU 유휴 시간과 과도한 패딩을 줄이기 위해, 데이터셋 분석부터 토큰·이미지 제약을 함께 고려하는 균형 잡힌 배낭식 배치 구성까지 단계적으로 개선한 사례다.

huggingface.co
#multimodal#agent-routing#ai-infrastructure#capex-cycle
Introducing Falcon-H1-Arabic: Pushing the Boundaries of Arabic Language AI with Hybrid Architecture
Article2025년 7월 14일

Introducing Falcon-H1-Arabic: Pushing the Boundaries of Arabic Language AI with Hybrid Architecture

팔콘 에이치원 아라빅은 맘바와 트랜스포머를 결합한 하이브리드 구조, 최대 25만 6천 토큰의 문맥 창, 아랍어 특화 데이터와 후속 학습을 통해 규모별 최고 수준의 아랍어 처리 성능을 목표로 한 3종 모델군이다.

huggingface.co
#ai-architecture#agent-routing#workflow-automation#llm
ScreenEnv: Deploy your full stack Desktop Agent
Article2025년 7월 11일

ScreenEnv: Deploy your full stack Desktop Agent

ScreenEnv는 Docker 기반의 격리된 우분투 데스크톱과 직접 제어 API·MCP 연동을 제공해 GUI 에이전트의 개발, 테스트, 배포를 단순화하는 Python 라이브러리다.

huggingface.co
#anthropic#ai-architecture#agent-deployment#agent-routing
Kimina-Prover: Applying Test-time RL Search on Large Formal Reasoning Models
Article2025년 7월 10일

Kimina-Prover: Applying Test-time RL Search on Large Formal Reasoning Models

김이나 프로버는 중간 보조정리를 재귀적으로 생성·선별·결합하는 테스트 시점 강화학습 탐색과 린 오류 기반 교정 기능을 통해 미니에프투에프에서 92.2%의 최고 통과율을 기록한 형식 정리 증명 모델이다.

huggingface.co
#anthropic#agent-routing#search-advertising#workflow-automation
Migrating data from Postgres to Convex
Article2025년 7월 8일

Migrating data from Postgres to Convex

Postgres 데이터를 Convex로 이전하는 방법은 소규모 데이터의 JSONL 덤프·가져오기에서 시작해, 스키마 정의와 관계 필드의 Convex ID 전환, 필요 시 Airbyte 기반 스트리밍 가져오기까지 이어진다.

stack.convex.dev
#agent-routing#llm#semiconductors#applications
이전1…18192021222320 / 23다음