Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-routing
Tag552건YouTube 1Article 551

#agent-routing

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 522 · 연관도 61%#applications공동문서 464 · 연관도 59%#semiconductors공동문서 483 · 연관도 59%#workflow-automation공동문서 142 · 연관도 49%#ai-architecture공동문서 190 · 연관도 37%#agent-memory공동문서 206 · 연관도 37%#privacy-design공동문서 163 · 연관도 33%#service-design공동문서 137 · 연관도 31%#retrieval-index공동문서 107 · 연관도 28%#agent-deployment공동문서 122 · 연관도 28%
Evaluating Audio Reasoning with Big Bench Audio
Article2024년 12월 20일

Evaluating Audio Reasoning with Big Bench Audio

빅 벤치 오디오 평가 결과, 음성을 직접 처리하는 모델은 텍스트 기반 추론보다 정확도가 크게 낮았으며 추론이 중요한 환경에서는 음성 인식·텍스트 추론·음성 합성을 연결한 파이프라인이 더 우수했다.

huggingface.co
#anthropic#agent-routing#workflow-automation#llm
Add a collaborative document editor to your app
Article2024년 12월 19일

Add a collaborative document editor to your app

단순한 <textarea 로는 동시 편집이 충돌하므로, Convex와 ProseMirror 기반 동기화 컴포넌트, Tiptap 또는 BlockNote를 조합해 기존 앱에 협업 문서 편집기를 붙이는 절차를 설명한다.

stack.convex.dev
#agent-routing#llm#semiconductors#applications
Elon Musk wanted an OpenAI for-profit
Article2024년 12월 13일

Elon Musk wanted an OpenAI for-profit

오픈AI는 일론 머스크가 영리 구조 자체에 반대했던 것이 아니라 2017년 영리 전환을 추진하면서 지분 과반, 절대적 통제권, 최고경영자 지위를 요구했고, 그 조건이 받아들여지지 않자 회사를 떠났다고 주장한다.

openai.com
#openai#privacy-design#ai-architecture#agent-routing
Sora System Card
Article2024년 12월 9일

Sora System Card

Sora는 텍스트·이미지·영상을 입력받아 최대 1080p·20초 영상을 생성하거나 편집하는 모델이며, OpenAI는 데이터 필터링, 외부 레드팀, 내부 평가, 입출력 분류기와 제품 제한을 결합해 오용 위험을 줄이고자 했다.

openai.com
#openai#privacy-design#ai-architecture#multimodal
How Cargo Powers GTM Workflows with Reliable Web Data from Firecrawl
Article2024년 12월 6일

How Cargo Powers GTM Workflows with Reliable Web Data from Firecrawl

Cargo는 Firecrawl의 안정적인 웹페이지 스크래핑과 구조화 출력으로 GTM 팀의 산업 분류, 메시지 개인화, 데이터 보강 워크플로를 자동화한다.

Eric Ciarla
#agent-routing#workflow-automation#llm#semiconductors
Fast LoRA inference for Flux with Diffusers and PEFT
Article2024년 12월 5일

Fast LoRA inference for Flux with Diffusers and PEFT

Diffusers와 PEFT의 LoRA 핫스와핑, torch.compile, FP8 양자화, Flash Attention 3를 조합해 Flux.1 Dev의 재컴파일 문제를 피하고 고성능 GPU에서 약 2.23배, RTX 4090에서 약 2.04배 빠른 LoRA 추론을 구현한 최적화 방법을 설명한다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#context-compression
Going local-first with Automerge and Convex
Article2024년 11월 19일

Going local-first with Automerge and Convex

이 글은 Automerge의 CRDT 기반 로컬 우선 편집 모델과 Convex 백엔드를 함께 사용해 오프라인 편집, 충돌 없는 협업, 서버 기반 권한·관계·동기화를 결합하는 방법을 설명한다.

stack.convex.dev
#ai-architecture#agent-routing#llm#semiconductors
Rox goes “all in” on OpenAI
Article2024년 11월 19일

Rox goes “all in” on OpenAI

록스는 오픈AI의 모델과 API를 기반으로 데이터, 영업 흐름, 상시 작동 에이전트를 결합한 맞춤형 매출 운영 플랫폼을 구축하고 기업 고객 확대와 영업 생산성 향상을 이루고 있다.

openai.com
#openai#agent-swarms#multimodal#agent-deployment
Data-driven beauty: How The Estée Lauder Companies unlocks insights with ChatGPT
Article2024년 11월 13일

Data-driven beauty: How The Estée Lauder Companies unlocks insights with ChatGPT

에스티 로더 컴퍼니즈는 ChatGPT Enterprise와 사내 GPT Lab을 활용해 방대한 소비자·임상 데이터를 빠르게 분석하고, 직원의 반복 업무를 줄이면서 제품 개발과 마케팅의 창의성 및 시장 대응 속도를 높였다.

openai.com
#openai#privacy-design#ai-architecture#agent-memory
Launch Week II Recap
Article2024년 11월 4일

Launch Week II Recap

Firecrawl은 두 번째 Launch Week 동안 대량 스크래핑, 지역·언어 설정, 결제 유연성, iframe 처리, 자동화 액션, 모바일 스크래핑, 더 빠른 Markdown 파싱 등 웹 데이터 수집 기능을 7일에 걸쳐 공개했다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Promega's top-down adoption of ChatGPT accelerates manufacturing, sales, and marketing
Article2024년 10월 31일

Promega's top-down adoption of ChatGPT accelerates manufacturing, sales, and marketing

생명과학 기업 프로메가는 경영진 주도의 챗GPT 도입과 맞춤형 GPT 확산을 통해 제조 계획, 품질 대응, 영업 분석, 마케팅 실행의 속도와 효율을 높였다.

openai.com
#openai#privacy-design#agent-routing#llm
Launch Week II - Day 1: Announcing the Batch Scrape Endpoint
Article2024년 10월 28일

Launch Week II - Day 1: Announcing the Batch Scrape Endpoint

Firecrawl은 Launch Week II 첫날 여러 URL을 한 번에 스크랩할 수 있는 Batch Scrape 엔드포인트를 공개하고, 동기·비동기 처리 방식과 사용 예시를 함께 안내했다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub
Article2024년 9월 25일

Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub

엔비디아 라마 네모트론 나노 VL은 복잡한 문서의 문자·표·차트·수식·배치를 정밀하게 인식하고 위치 정보까지 제공하도록 설계된 80억 매개변수급 시각언어모델이다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-routing
Handling 300k requests per day: an adventure in scaling
Article2024년 9월 13일

Handling 300k requests per day: an adventure in scaling

Firecrawl 팀은 사용자 증가로 API와 크롤링 작업이 불안정해지자 큐 락 설정, 스크레이프 처리 구조, 크롤 작업 단위, 큐 라이브러리, Redis 인프라를 단계적으로 바꾸며 하루 30만 요청 규모에 대응했다.

firecrawl.dev
#privacy-design#service-design#ai-architecture#agent-routing
How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl
Article2024년 9월 10일

How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl

Athena Intelligence는 Firecrawl로 웹 콘텐츠를 LLM이 바로 활용할 수 있는 형태로 수집해, 규제 산업의 기업 분석가에게 최신 공개 데이터 기반 인사이트를 제공하는 AI 동료를 구현한다.

Eric Ciarla
#service-design#agent-routing#llm#semiconductors
Launch Week I Recap
Article2024년 9월 2일

Launch Week I Recap

Firecrawl의 첫 Launch Week는 Teams, rate limit 확대, Map endpoint, /v1 API, WebSockets, LLM Extract, Crawl Webhooks를 순차 공개하며 웹 스크래핑 협업·성능·실시간성·통합성을 강화한 행사였다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Launch Week I / Day 7: Crawl Webhooks (v1)
Article2024년 9월 1일

Launch Week I / Day 7: Crawl Webhooks (v1)

Firecrawl은 /crawl 엔드포인트에 웹훅을 추가해 크롤 시작, 페이지별 처리, 완료, 실패 상태를 지정한 URL로 POST 전송할 수 있게 했습니다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
Remote VAEs for decoding with Inference Endpoints 🤗
Article2024년 8월 16일

Remote VAEs for decoding with Inference Endpoints 🤗

고해상도 이미지·영상 생성에서 큰 메모리를 차지하는 가변 오토인코더 디코딩을 원격 추론 엔드포인트에 맡겨 소비자용 그래픽 처리 장치의 부담을 줄이고 생성과 디코딩을 병렬화하는 실험적 기능을 소개한다.

huggingface.co
#agent-memory#agent-routing#capex-cycle#retrieval-index
Firecrawl June 2024 Updates
Article2024년 6월 30일

Firecrawl June 2024 Updates

Firecrawl의 2024년 6월 업데이트는 Gamma, Dify, Praison, Flowise 연동, 새 대시보드, 플랫폼 기능 개선, 신규 튜토리얼 공개를 중심으로 진행됐다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
Introducing SyGra Studio
Article2024년 4월 4일

Introducing SyGra Studio

SyGra Studio는 합성 데이터 생성 흐름을 시각적으로 구성하고, 생성되는 설정과 실행 상태·비용·결과를 한 화면에서 확인할 수 있게 만든 대화형 작업 환경이다.

huggingface.co
#ai-architecture#agent-routing#context-compression#prompt-library
Welcome EmbeddingGemma, Google's new efficient embedding model
Article2024년 2월 21일

Welcome EmbeddingGemma, Google's new efficient embedding model

임베딩젬마는 3억 800만 개 매개변수와 2,048토큰 문맥 길이, 100개 이상 언어 지원, 차원 축소 기능을 결합해 일상적인 기기에서도 고품질 다국어 임베딩을 생성하도록 설계된 구글의 소형 모델이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#search-advertising
No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL
Article2024년 2월 5일

No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL

TRL의 co located vLLM은 GRPO의 학습과 생성을 동일한 GPU·분산 프로세스 그룹에서 번갈아 실행해 유휴 시간과 통신 비용을 줄이며, 모델 크기와 텐서 병렬화 설정에 따라 최대 1.73배의 처리량 향상을 보였다.

huggingface.co
#ai-architecture#multimodal#agent-routing#capex-cycle
AI Canon
Article2023년 5월 25일

AI Canon

a16z의 ‘AI Canon’은 현대 AI를 이해하기 위해 영향력이 컸던 논문, 글, 강의, 실무 가이드, 시장 분석 자료를 단계별로 묶은 선별 참고 목록이다.

Derrick Harris, Matt Bornstein, Guido Appenzeller
#anthropic#privacy-design#ai-architecture#agent-routing
Asynchronous Robot Inference: Decoupling Action Prediction and Execution
Article2023년 4월 23일

Asynchronous Robot Inference: Decoupling Action Prediction and Execution

로봇 정책이 미래 행동 묶음을 예측하는 동안 실행을 멈추는 문제를 줄이기 위해, 글은 행동 예측과 실행을 분리하는 비동기 추론 구조로 지연을 제거하고 더 촘촘한 제어 루프를 만드는 방법을 설명합니다.

huggingface.co
#ai-architecture#multimodal#agent-routing#llm
이전1…21222323 / 23다음