Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-memory
Tag543건YouTube 19Article 524

#agent-memory

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#retrieval-index공동문서 248 · 연관도 66%#context-compression공동문서 286 · 연관도 60%#semiconductors공동문서 457 · 연관도 56%#applications공동문서 432 · 연관도 56%#llm공동문서 468 · 연관도 55%#agent-routing공동문서 201 · 연관도 37%#ai-architecture공동문서 152 · 연관도 30%#agent-deployment공동문서 98 · 연관도 23%#vision-language-models공동문서 64 · 연관도 20%#multimodal공동문서 66 · 연관도 20%
The Open Arabic LLM Leaderboard 2
Article2024년 8월 27일

The Open Arabic LLM Leaderboard 2

오픈 아랍어 LLM 리더보드 2는 기존 평가의 번역 편향·포화·검증 오류를 바로잡고, 아랍어 고유 특성과 실제 활용을 반영한 원어·인간 검수 벤치마크와 생성형 평가를 확대한 개편판이다.

huggingface.co
#agent-memory#context-compression#retrieval-index#llm
Remote VAEs for decoding with Inference Endpoints 🤗
Article2024년 8월 16일

Remote VAEs for decoding with Inference Endpoints 🤗

고해상도 이미지·영상 생성에서 큰 메모리를 차지하는 가변 오토인코더 디코딩을 원격 추론 엔드포인트에 맡겨 소비자용 그래픽 처리 장치의 부담을 줄이고 생성과 디코딩을 병렬화하는 실험적 기능을 소개한다.

huggingface.co
#agent-memory#agent-routing#capex-cycle#retrieval-index
Train 400x faster Static Embedding Models with Sentence Transformers
Article2024년 8월 9일

Train 400x faster Static Embedding Models with Sentence Transformers

이 글은 Sentence Transformers로 정적 임베딩 모델을 현대식 대조학습과 Matryoshka Representation Learning으로 학습해 CPU 추론 속도를 기존 주요 임베딩 모델보다 100~400배 높이면서도 여러 벤치마크에서 성능의 상당 부분을 유지하는 방법을 소개한다.

huggingface.co
#luxury-hospitality#luxury-travel#ai-architecture#multimodal
Announcing Fire Engine for Firecrawl
Article2024년 8월 6일

Announcing Fire Engine for Firecrawl

Firecrawl은 외부 스크래핑 서비스의 실패와 속도 문제를 해결하기 위해 자체 기본 백엔드인 Fire Engine을 도입했다고 발표했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Firecrawl June 2024 Updates
Article2024년 6월 30일

Firecrawl June 2024 Updates

Firecrawl의 2024년 6월 업데이트는 Gamma, Dify, Praison, Flowise 연동, 새 대시보드, 플랫폼 기능 개선, 신규 튜토리얼 공개를 중심으로 진행됐다.

Nicolas Camara
#agent-routing#llm#semiconductors#applications
How much does it cost to train frontier AI models?
Article2024년 6월 3일

How much does it cost to train frontier AI models?

Epoch AI는 프런티어 AI 모델의 최종 훈련 비용이 2016년 이후 연 2~3배 수준으로 빠르게 증가해 왔으며, 현재 추세가 이어지면 2027년 최대 규모 훈련 실행은 10억 달러를 넘을 수 있다고 분석한다.

Ben Cottier
#llm#semiconductors#applications#agent-deployment
Do the returns to software R&D point towards a singularity?
Article2024년 5월 17일

Do the returns to software R&D point towards a singularity?

이 글은 소프트웨어 연구개발의 수익률이 1을 넘을 경우 AI가 자기 연구개발을 자동화하면서 초쌍곡적 성장, 즉 소프트웨어 특이점으로 이어질 수 있는지 이론과 제한적 실증 자료로 검토한다.

Tamay Besiroglu
#luxury-hospitality#luxury-travel#travel-hospitality#llm
Welcome EmbeddingGemma, Google's new efficient embedding model
Article2024년 2월 21일

Welcome EmbeddingGemma, Google's new efficient embedding model

임베딩젬마는 3억 800만 개 매개변수와 2,048토큰 문맥 길이, 100개 이상 언어 지원, 차원 축소 기능을 결합해 일상적인 기기에서도 고품질 다국어 임베딩을 생성하도록 설계된 구글의 소형 모델이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#search-advertising
Training and Finetuning Sparse Embedding Models with Sentence Transformers
Article2024년 2월 19일

Training and Finetuning Sparse Embedding Models with Sentence Transformers

이 글은 Sentence Transformers로 희소 임베딩 모델을 미세조정하는 이유와 기본 구성요소를 설명하며, SPLADE 계열 모델의 해석 가능성·확장 방식·도메인 적응 필요성을 실용 예제로 보여준다.

huggingface.co
#ai-architecture#multimodal#llm#vision-language-models
🐯 Liger GRPO meets TRL
Article2024년 2월 5일

🐯 Liger GRPO meets TRL

라이거의 청크 단위 손실 계산을 TRL의 그룹 상대 정책 최적화에 통합해 모델 품질을 유지하면서 최대 GPU 메모리를 40% 줄이고, 분산 학습과 매개변수 효율적 미세 조정 및 고속 생성 서버 연계까지 지원한 결과를 소개한다.

huggingface.co
#agent-deployment#agent-memory#context-compression#retrieval-index
All About the U.S. Executive Order on AI Use and Development
Article2023년 11월 1일

All About the U.S. Executive Order on AI Use and Development

바이든 행정부의 AI 행정명령은 국방·비상권한에 근거해 일부 기초 모델의 보고·시험을 요구하고, 연방기관이 안전·프라이버시·차별·경쟁력·국제표준 관련 기준을 마련하도록 지시한 조치다.

@DeepLearningAI
#anthropic#privacy-design#llm#semiconductors
Supporting the Open Source AI Community
Article2023년 8월 30일

Supporting the Open Source AI Community

a16z는 오픈소스 AI 생태계가 폐쇄형 모델과 경쟁할 수준으로 성장하고 있지만 개발자들이 GPU 등 자원 부족을 겪고 있다며, 이를 지원하기 위한 오픈소스 AI 보조금 프로그램과 첫 수혜 프로젝트들을 발표했다.

Matt Bornstein, Rajko Radovanovic
#ai-distribution#ai-infrastructure#capex-cycle#search-advertising
Why AI Will Save the World
Article2023년 6월 6일

Why AI Will Save the World

마크 안드리센은 AI를 인간 지능을 증강해 교육·과학·경제·예술·의사결정을 개선할 도구로 보고, 현재의 AI 공포와 규제 요구를 역사적 기술 도덕 공황 및 이해관계의 산물로 비판한다.

Marc Andreessen
#ai-architecture#change-management#organizational-redesign#travel-hospitality
Will we run out of ML data? Projecting dataset size trends
Article2022년 11월 10일

Will we run out of ML data? Projecting dataset size trends

Epoch AI는 현재의 ML 데이터 사용 증가 추세가 지속되고 데이터 효율성 혁신이 없다는 가정 아래, 고품질 언어 데이터는 2026년 전, 저품질 언어 데이터와 이미지 데이터는 2030~2060년 사이에 병목이 될 수 있다고 전망한다.

Pablo Villalobos
#llm#semiconductors#applications#agent-memory
TRL v1.0: Post-Training Library Built to Move with the Field
Article2017년 7월 20일

TRL v1.0: Post-Training Library Built to Move with the Field

TRL v1.0은 빠르게 변하는 포스트트레이닝 분야에서 안정적인 핵심 API와 실험적 방법을 함께 수용하도록 설계된 Hugging Face 생태계의 범용 포스트트레이닝 라이브러리다.

huggingface.co
#service-design#ai-architecture#agent-memory#context-compression
이전1…21222323 / 23다음