Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#llm
Tag1292건YouTube 48Article 1244

#llm

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

Alias / 동의어

large-language-models

연관 태그

#semiconductors공동문서 1040 · 연관도 83%#applications공동문서 974 · 연관도 81%#agent-routing공동문서 512 · 연관도 61%#agent-memory공동문서 468 · 연관도 55%#ai-architecture공동문서 403 · 연관도 51%#privacy-design공동문서 384 · 연관도 50%#context-compression공동문서 342 · 연관도 47%#agent-deployment공동문서 312 · 연관도 47%#service-design공동문서 286 · 연관도 42%#retrieval-index공동문서 213 · 연관도 37%
Mini-R1: Reproduce Deepseek R1 „aha moment“ a RL tutorial
Article2024년 9월 25일

Mini-R1: Reproduce Deepseek R1 „aha moment“ a RL tutorial

3B 규모의 큐원 모델을 카운트다운 산술 과제와 그룹 상대 정책 최적화로 훈련해, 별도의 인간 피드백 없이 풀이를 검토하고 탐색하는 딥시크 R1의 작은 ‘아하 순간’을 재현한 강화학습 실험이다.

huggingface.co
#nvidia#service-design#agent-memory#capex-cycle
Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub
Article2024년 9월 25일

Welcome the NVIDIA Llama Nemotron Nano VLM to Hugging Face Hub

엔비디아 라마 네모트론 나노 VL은 복잡한 문서의 문자·표·차트·수식·배치를 정밀하게 인식하고 위치 정보까지 제공하도록 설계된 80억 매개변수급 시각언어모델이다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-routing
Expert Support case study: Bolstering a RAG app with LLM-as-a-Judge
Article2024년 9월 13일

Expert Support case study: Bolstering a RAG app with LLM-as-a-Judge

Digital Green은 농업 RAG 챗봇 Farmer.chat의 응답 품질을 대규모로 평가하기 위해 LLM as a Judge 체계를 구축하고, 충실도와 답변률의 균형을 기준으로 생성 모델을 비교·선정했다.

huggingface.co
#service-design#ai-architecture#agent-memory#context-compression
Handling 300k requests per day: an adventure in scaling
Article2024년 9월 13일

Handling 300k requests per day: an adventure in scaling

Firecrawl 팀은 사용자 증가로 API와 크롤링 작업이 불안정해지자 큐 락 설정, 스크레이프 처리 구조, 크롤 작업 단위, 큐 라이브러리, Redis 인프라를 단계적으로 바꾸며 하루 30만 요청 규모에 대응했다.

firecrawl.dev
#privacy-design#service-design#ai-architecture#agent-routing
How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl
Article2024년 9월 10일

How Athena Intelligence Powers Enterprise AI Analysts with Web Data from Firecrawl

Athena Intelligence는 Firecrawl로 웹 콘텐츠를 LLM이 바로 활용할 수 있는 형태로 수집해, 규제 산업의 기업 분석가에게 최신 공개 데이터 기반 인사이트를 제공하는 AI 동료를 구현한다.

Eric Ciarla
#service-design#agent-routing#llm#semiconductors
Introducing HUGS - Scale your AI with Open Models
Article2024년 9월 9일

Introducing HUGS - Scale your AI with Open Models

HUGS는 Hugging Face가 공개 모델을 자체 인프라에서 빠르게 배포·확장하도록 제안한 무설정 최적화 추론 마이크로서비스였으며, 2025년 9월 기준 해당 모델 배포 컨테이너 제공은 중단되었다.

huggingface.co
#service-design#agent-deployment#ai-safety#llm
Launch Week I Recap
Article2024년 9월 2일

Launch Week I Recap

Firecrawl의 첫 Launch Week는 Teams, rate limit 확대, Map endpoint, /v1 API, WebSockets, LLM Extract, Crawl Webhooks를 순차 공개하며 웹 스크래핑 협업·성능·실시간성·통합성을 강화한 행사였다.

Eric Ciarla
#agent-routing#llm#semiconductors#applications
Launch Week I / Day 7: Crawl Webhooks (v1)
Article2024년 9월 1일

Launch Week I / Day 7: Crawl Webhooks (v1)

Firecrawl은 /crawl 엔드포인트에 웹훅을 추가해 크롤 시작, 페이지별 처리, 완료, 실패 상태를 지정한 URL로 POST 전송할 수 있게 했습니다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
Launch Week I / Day 4: Announcing Firecrawl /v1
Article2024년 8월 29일

Launch Week I / Day 4: Announcing Firecrawl /v1

Firecrawl은 Launch Week 4일차에 더 안정적이고 개발자 친화적인 웹 데이터 수집 API인 Firecrawl /v1을 공개하며 출력 형식, 크롤 상태, 마크다운 파싱, SDK, /map 엔드포인트를 개선했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Falling LLM Token Prices and What They Mean for AI Companies
Article2024년 8월 28일

Falling LLM Token Prices and What They Mean for AI Companies

LLM 토큰 가격은 오픈웨이트 모델 경쟁, 하드웨어 혁신, 추론 기술 개선으로 빠르게 하락하고 있으며, AI 기업은 비용 최적화보다 유용한 애플리케이션 구축과 주기적 모델 전환 검토에 집중해야 한다.

@DeepLearningAI
#openai#gpt-4#gpt-4o#openai-batch-api
Launch Week I / Day 3: Introducing the Map Endpoint
Article2024년 8월 28일

Launch Week I / Day 3: Introducing the Map Endpoint

Firecrawl은 첫 Launch Week 3일 차에 단일 URL을 웹사이트 전체 URL 목록으로 빠르게 확장해 주는 Alpha 단계의 Map Endpoint를 공개했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Launch Week I / Day 2: 2x Rate Limits
Article2024년 8월 27일

Launch Week I / Day 2: 2x Rate Limits

Firecrawl은 첫 Launch Week 둘째 날 모든 요금제의 /scrape 엔드포인트 요청 한도를 두 배로 늘렸다고 발표했습니다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
The Open Arabic LLM Leaderboard 2
Article2024년 8월 27일

The Open Arabic LLM Leaderboard 2

오픈 아랍어 LLM 리더보드 2는 기존 평가의 번역 편향·포화·검증 오류를 바로잡고, 아랍어 고유 특성과 실제 활용을 반영한 원어·인간 검수 벤치마크와 생성형 평가를 확대한 개편판이다.

huggingface.co
#agent-memory#context-compression#retrieval-index#llm
Remote VAEs for decoding with Inference Endpoints 🤗
Article2024년 8월 16일

Remote VAEs for decoding with Inference Endpoints 🤗

고해상도 이미지·영상 생성에서 큰 메모리를 차지하는 가변 오토인코더 디코딩을 원격 추론 엔드포인트에 맡겨 소비자용 그래픽 처리 장치의 부담을 줄이고 생성과 디코딩을 병렬화하는 실험적 기능을 소개한다.

huggingface.co
#agent-memory#agent-routing#capex-cycle#retrieval-index
Train 400x faster Static Embedding Models with Sentence Transformers
Article2024년 8월 9일

Train 400x faster Static Embedding Models with Sentence Transformers

이 글은 Sentence Transformers로 정적 임베딩 모델을 현대식 대조학습과 Matryoshka Representation Learning으로 학습해 CPU 추론 속도를 기존 주요 임베딩 모델보다 100~400배 높이면서도 여러 벤치마크에서 성능의 상당 부분을 유지하는 방법을 소개한다.

huggingface.co
#luxury-hospitality#luxury-travel#ai-architecture#multimodal
How Gamma Supercharges Onboarding with Firecrawl
Article2024년 8월 8일

How Gamma Supercharges Onboarding with Firecrawl

Gamma는 Firecrawl을 활용해 웹페이지, 블로그 글, Notion 페이지 등 URL 기반 콘텐츠를 깨끗한 마크다운으로 가져오고, 이를 Gamma Sites와 AI 발표자료 생성 기능의 입력으로 전환한다.

Eric Ciarla
#ai-distribution#search-advertising#zero-click-search#llm
Announcing Fire Engine for Firecrawl
Article2024년 8월 6일

Announcing Fire Engine for Firecrawl

Firecrawl은 외부 스크래핑 서비스의 실패와 속도 문제를 해결하기 위해 자체 기본 백엔드인 Fire Engine을 도입했다고 발표했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Firecrawl July 2024 Updates
Article2024년 7월 31일

Firecrawl July 2024 Updates

Firecrawl은 2024년 7월 업데이트에서 YC 런치, scrape·crawl 성능과 대시보드 개선, 새 템플릿과 커뮤니티 사례, 채용 소식을 발표했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Firecrawl June 2024 Updates
Article2024년 6월 30일

Firecrawl June 2024 Updates

Firecrawl의 2024년 6월 업데이트는 Gamma, Dify, Praison, Flowise 연동, 새 대시보드, 플랫폼 기능 개선, 신규 튜토리얼 공개를 중심으로 진행됐다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
How much does it cost to train frontier AI models?
Article2024년 6월 3일

How much does it cost to train frontier AI models?

Epoch AI는 프런티어 AI 모델의 최종 훈련 비용이 2016년 이후 연 2~3배 수준으로 빠르게 증가해 왔으며, 현재 추세가 이어지면 2027년 최대 규모 훈련 실행은 10억 달러를 넘을 수 있다고 분석한다.

Ben Cottier
#llm#semiconductors#applications#agent-deployment
Training compute of frontier AI models grows by 4-5x per year
Article2024년 5월 28일

Training compute of frontier AI models grows by 4-5x per year

Epoch AI는 최신 데이터 확장을 바탕으로, 프런티어 AI 모델의 학습 컴퓨트가 최근 연간 약 4~5배 속도로 증가해 왔다고 결론짓는다.

Jaime Sevilla
#openai#epoch-ai#google-deepmind#jaime-sevilla
Do the returns to software R&D point towards a singularity?
Article2024년 5월 17일

Do the returns to software R&D point towards a singularity?

이 글은 소프트웨어 연구개발의 수익률이 1을 넘을 경우 AI가 자기 연구개발을 자동화하면서 초쌍곡적 성장, 즉 소프트웨어 특이점으로 이어질 수 있는지 이론과 제한적 실증 자료로 검토한다.

Tamay Besiroglu
#luxury-hospitality#luxury-travel#travel-hospitality#llm
Introducing SyGra Studio
Article2024년 4월 4일

Introducing SyGra Studio

SyGra Studio는 합성 데이터 생성 흐름을 시각적으로 구성하고, 생성되는 설정과 실행 상태·비용·결과를 한 화면에서 확인할 수 있게 만든 대화형 작업 환경이다.

huggingface.co
#ai-architecture#agent-routing#context-compression#prompt-library
Algorithmic progress in language models
Article2024년 3월 12일

Algorithmic progress in language models

Epoch AI는 사전학습 언어모델에서 같은 성능에 필요한 컴퓨트가 약 8개월마다 절반으로 줄었지만, 지난 10년의 성능 향상은 알고리즘 혁신보다 컴퓨트와 데이터 확장의 영향이 더 컸다고 분석한다.

Anson Ho
#model-scaling#ai-architecture#capex-cycle#llm
이전1…5152535453 / 54다음