Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#workflow-automation
Tag145건YouTube 1Article 144

#workflow-automation

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-routing공동문서 137 · 연관도 48%#llm공동문서 139 · 연관도 32%#semiconductors공동문서 125 · 연관도 30%#applications공동문서 116 · 연관도 29%#ai-architecture공동문서 62 · 연관도 24%#agent-deployment공동문서 39 · 연관도 17%#agent-memory공동문서 45 · 연관도 16%#service-design공동문서 35 · 연관도 15%#multimodal공동문서 25 · 연관도 15%#vision-language-models공동문서 24 · 연관도 15%
Prefill and Decode for Concurrent Requests - Optimizing LLM Performance
Article2025년 7월 28일

Prefill and Decode for Concurrent Requests - Optimizing LLM Performance

동시 요청을 처리하는 LLM 추론에서는 프리필과 디코드의 계산 특성이 달라, 첫 토큰 지연·토큰 생성 지연·총처리량·GPU 활용률 사이의 균형에 맞춰 배칭과 프리필 청크 크기를 조정해야 한다.

huggingface.co
#agent-memory#agent-routing#retrieval-index#workflow-automation
Ulysses Sequence Parallelism: Training with Million-Token Contexts
Article2025년 7월 26일

Ulysses Sequence Parallelism: Training with Million-Token Contexts

Ulysses Sequence Parallelism은 긴 시퀀스 학습에서 시퀀스와 어텐션 헤드를 함께 나누고 all to all 통신으로 재배치해, 단일 GPU 메모리 한계를 넘어 수십만~백만 토큰 문맥 학습을 가능하게 하는 방식이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#retrieval-index
Efficient MultiModal Data Pipeline
Article2025년 7월 14일

Efficient MultiModal Data Pipeline

멀티모달 학습의 GPU 유휴 시간과 과도한 패딩을 줄이기 위해, 데이터셋 분석부터 토큰·이미지 제약을 함께 고려하는 균형 잡힌 배낭식 배치 구성까지 단계적으로 개선한 사례다.

huggingface.co
#multimodal#agent-routing#ai-infrastructure#capex-cycle
Introducing Falcon-H1-Arabic: Pushing the Boundaries of Arabic Language AI with Hybrid Architecture
Article2025년 7월 14일

Introducing Falcon-H1-Arabic: Pushing the Boundaries of Arabic Language AI with Hybrid Architecture

팔콘 에이치원 아라빅은 맘바와 트랜스포머를 결합한 하이브리드 구조, 최대 25만 6천 토큰의 문맥 창, 아랍어 특화 데이터와 후속 학습을 통해 규모별 최고 수준의 아랍어 처리 성능을 목표로 한 3종 모델군이다.

huggingface.co
#ai-architecture#agent-routing#workflow-automation#llm
Kimina-Prover: Applying Test-time RL Search on Large Formal Reasoning Models
Article2025년 7월 10일

Kimina-Prover: Applying Test-time RL Search on Large Formal Reasoning Models

김이나 프로버는 중간 보조정리를 재귀적으로 생성·선별·결합하는 테스트 시점 강화학습 탐색과 린 오류 기반 교정 기능을 통해 미니에프투에프에서 92.2%의 최고 통과율을 기록한 형식 정리 증명 모델이다.

huggingface.co
#anthropic#agent-routing#search-advertising#workflow-automation
How Long Prompts Block Other Requests - Optimizing LLM Performance
Article2025년 6월 12일

How Long Prompts Block Other Requests - Optimizing LLM Performance

긴 프롬프트가 포함된 요청은 프리필 대기열과 동시 디코딩을 지연시키며, 요청 병렬 프리필은 첫 토큰 지연을 줄이고 프리필·디코드 분리 구조는 토큰 생성 간섭을 완화한다.

huggingface.co
#ai-architecture#agent-deployment#agent-routing#workflow-automation
Holo1: New family of GUI automation VLMs powering GUI agent Surfer-H
Article2025년 6월 9일

Holo1: New family of GUI automation VLMs powering GUI agent Surfer-H

H Company는 웹 UI를 이해하고 클릭 위치를 정밀하게 찾는 오픈소스 액션 비전 언어 모델 Holo1과 1,639개 UI 과제로 구성된 WebClick 벤치마크를 공개했으며, 이를 기반으로 브라우저 자동화 에이전트 Surfer H를 구동한다고 밝혔다.

huggingface.co
#ai-architecture#multimodal#workflow-automation#llm
How Answer HQ Powers AI Customer Support for Businesses with Firecrawl
Article2025년 6월 5일

How Answer HQ Powers AI Customer Support for Businesses with Firecrawl

Answer HQ는 소규모 기업의 기존 웹사이트 콘텐츠를 AI 고객지원 도우미에 연결하기 위해 Firecrawl을 웹사이트 가져오기 기능의 핵심 인프라로 사용한다.

Eric Ciarla
#agent-routing#workflow-automation#llm#semiconductors
Welcome Llama 4 Maverick & Scout on Hugging Face
Article2025년 5월 22일

Welcome Llama 4 Maverick & Scout on Hugging Face

Meta의 네이티브 멀티모달 MoE 모델 Llama 4 Maverick과 Scout가 출시 당일부터 Hugging Face Hub, Transformers, TGI, 양자화 및 Xet 저장소를 통해 제공되며, 최대 1천만 토큰 문맥과 강력한 추론·이미지·코딩 성능을 지원한다.

huggingface.co
#ai-architecture#multimodal#agent-deployment#agent-routing
How to think about agent frameworks
Article2025년 4월 20일

How to think about agent frameworks

제공된 source body는 ‘에이전트 프레임워크를 어떻게 생각할 것인가’라는 본문이 아니라, Webflow 기반 페이지의 전역 CSS·반응형 레이아웃·표·블로그 카드·리치 텍스트 스타일을 정의한 스타일 코드입니다.

LangChain Accounts
#anthropic#agent-routing#workflow-automation#travel-hospitality
Integrations Day: Launch Week III - Day 7
Article2025년 4월 20일

Integrations Day: Launch Week III - Day 7

Firecrawl의 Launch Week III 7일차는 Integrations Day로, 기존 도구와 워크플로에 Firecrawl을 더 쉽게 연결하도록 20개 이상 플랫폼 통합을 강조한 발표입니다.

Eric Ciarla
#agent-routing#workflow-automation#llm#semiconductors
Mixture of Experts (MoEs) in Transformers
Article2025년 3월 27일

Mixture of Experts (MoEs) in Transformers

전문가 혼합 모델은 토큰마다 일부 전문가만 활성화해 전체 모델 용량과 실제 계산량을 분리하며, Transformers는 이를 효율적으로 지원하기 위해 가중치 로딩·실행 백엔드·전문가 병렬화 구조를 재설계했다.

huggingface.co
#kimi-k2-5#ai-architecture#transformer#agent-memory
Open-R1: a fully open reproduction of DeepSeek-R1
Article2025년 3월 27일

Open-R1: a fully open reproduction of DeepSeek-R1

Open R1은 DeepSeek R1에서 공개되지 않은 데이터셋과 학습 코드를 재구성해, 추론 모델의 증류·순수 강화학습·다단계 학습 과정을 누구나 검증하고 재현할 수 있도록 만들려는 오픈 프로젝트다.

huggingface.co
#anthropic#agent-routing#workflow-automation#llm
Optimize Transaction Throughput: 3 Patterns for Scaling with Convex and ACID Databases
Article2025년 1월 23일

Optimize Transaction Throughput: 3 Patterns for Scaling with Convex and ACID Databases

이 글은 직렬화 가능한 트랜잭션의 충돌을 줄여 처리량을 높이는 방법으로 큐, hot/cold 테이블 분리, predicate locking 세 가지 패턴을 설명한다.

stack.convex.dev
#agent-routing#workflow-automation#semiconductors#applications
Evaluating Audio Reasoning with Big Bench Audio
Article2024년 12월 20일

Evaluating Audio Reasoning with Big Bench Audio

빅 벤치 오디오 평가 결과, 음성을 직접 처리하는 모델은 텍스트 기반 추론보다 정확도가 크게 낮았으며 추론이 중요한 환경에서는 음성 인식·텍스트 추론·음성 합성을 연결한 파이프라인이 더 우수했다.

huggingface.co
#anthropic#agent-routing#workflow-automation#llm
Elon Musk wanted an OpenAI for-profit
Article2024년 12월 13일

Elon Musk wanted an OpenAI for-profit

오픈AI는 일론 머스크가 영리 구조 자체에 반대했던 것이 아니라 2017년 영리 전환을 추진하면서 지분 과반, 절대적 통제권, 최고경영자 지위를 요구했고, 그 조건이 받아들여지지 않자 회사를 떠났다고 주장한다.

openai.com
#openai#privacy-design#ai-architecture#agent-routing
How Cargo Powers GTM Workflows with Reliable Web Data from Firecrawl
Article2024년 12월 6일

How Cargo Powers GTM Workflows with Reliable Web Data from Firecrawl

Cargo는 Firecrawl의 안정적인 웹페이지 스크래핑과 구조화 출력으로 GTM 팀의 산업 분류, 메시지 개인화, 데이터 보강 워크플로를 자동화한다.

Eric Ciarla
#agent-routing#workflow-automation#llm#semiconductors
Launch Week II Recap
Article2024년 11월 4일

Launch Week II Recap

Firecrawl은 두 번째 Launch Week 동안 대량 스크래핑, 지역·언어 설정, 결제 유연성, iframe 처리, 자동화 액션, 모바일 스크래핑, 더 빠른 Markdown 파싱 등 웹 데이터 수집 기능을 7일에 걸쳐 공개했다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Handling 300k requests per day: an adventure in scaling
Article2024년 9월 13일

Handling 300k requests per day: an adventure in scaling

Firecrawl 팀은 사용자 증가로 API와 크롤링 작업이 불안정해지자 큐 락 설정, 스크레이프 처리 구조, 크롤 작업 단위, 큐 라이브러리, Redis 인프라를 단계적으로 바꾸며 하루 30만 요청 규모에 대응했다.

firecrawl.dev
#privacy-design#service-design#ai-architecture#agent-routing
How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl
Article2024년 9월 10일

How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl

Athena Intelligence는 Firecrawl로 웹 콘텐츠를 LLM이 바로 활용할 수 있는 형태로 수집해, 규제 산업의 기업 분석가에게 최신 공개 데이터 기반 인사이트를 제공하는 AI 동료를 구현한다.

Eric Ciarla
#service-design#agent-routing#llm#semiconductors
Launch Week I Recap
Article2024년 9월 2일

Launch Week I Recap

Firecrawl의 첫 Launch Week는 Teams, rate limit 확대, Map endpoint, /v1 API, WebSockets, LLM Extract, Crawl Webhooks를 순차 공개하며 웹 스크래핑 협업·성능·실시간성·통합성을 강화한 행사였다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Launch Week I / Day 7: Crawl Webhooks (v1)
Article2024년 9월 1일

Launch Week I / Day 7: Crawl Webhooks (v1)

Firecrawl은 /crawl 엔드포인트에 웹훅을 추가해 크롤 시작, 페이지별 처리, 완료, 실패 상태를 지정한 URL로 POST 전송할 수 있게 했습니다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
Remote VAEs for decoding with Inference Endpoints 🤗
Article2024년 8월 16일

Remote VAEs for decoding with Inference Endpoints 🤗

고해상도 이미지·영상 생성에서 큰 메모리를 차지하는 가변 오토인코더 디코딩을 원격 추론 엔드포인트에 맡겨 소비자용 그래픽 처리 장치의 부담을 줄이고 생성과 디코딩을 병렬화하는 실험적 기능을 소개한다.

huggingface.co
#agent-memory#agent-routing#capex-cycle#retrieval-index
Introducing SyGra Studio
Article2024년 4월 4일

Introducing SyGra Studio

SyGra Studio는 합성 데이터 생성 흐름을 시각적으로 구성하고, 생성되는 설정과 실행 상태·비용·결과를 한 화면에서 확인할 수 있게 만든 대화형 작업 환경이다.

huggingface.co
#ai-architecture#agent-routing#context-compression#prompt-library
이전1…45676 / 7다음