Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#retrieval-index
Tag248건YouTube 17Article 231

#retrieval-index

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-memory공동문서 248 · 연관도 66%#context-compression공동문서 160 · 연관도 50%#applications공동문서 197 · 연관도 38%#llm공동문서 213 · 연관도 37%#semiconductors공동문서 203 · 연관도 37%#agent-routing공동문서 103 · 연관도 28%#ai-architecture공동문서 82 · 연관도 24%#service-design공동문서 41 · 연관도 14%#gpu공동문서 17 · 연관도 12%#multimodal공동문서 25 · 연관도 11%
Introducing Nested Learning: A new ML paradigm for continual learning
Article2025년 11월 7일

Introducing Nested Learning: A new ML paradigm for continual learning

구글 리서치는 모델 구조와 최적화 규칙을 하나의 중첩된 학습 시스템으로 보는 Nested Learning을 제안하며, 지속 학습의 핵심 난제인 파국적 망각을 줄이는 새 설계 관점을 제시했다.

research.google
#privacy-design#ai-architecture#agent-memory#agent-routing
DS-STAR: A state-of-the-art versatile data science agent
Article2025년 11월 6일

DS-STAR: A state-of-the-art versatile data science agent

DS STAR는 다양한 데이터 형식 분석, LLM 기반 검증, 순차적 계획 개선을 결합해 복잡한 데이터 과학 작업을 자동화하고 주요 벤치마크에서 기존 에이전트보다 높은 성능을 보인 데이터 과학 에이전트입니다.

research.google
#agent-routing#llm#semiconductors#applications
Introducing Firecrawl v2.5 - The World's Best Web Data API
Article2025년 10월 30일

Introducing Firecrawl v2.5 - The World's Best Web Data API

Firecrawl v2.5는 자체 브라우저 스택과 Semantic Index를 통해 웹 데이터 추출의 품질, 커버리지, 속도, 신뢰성을 높였다고 발표한 릴리스입니다.

Eric Ciarla
#ai-architecture#agent-memory#context-compression#retrieval-index
StreetReaderAI: Towards making street view accessible via context-aware multimodal AI
Article2025년 10월 29일

StreetReaderAI: Towards making street view accessible via context-aware multimodal AI

StreetReaderAI는 시각장애인과 저시력 사용자가 스트리트뷰 장면을 음성 설명, 대화형 AI, 접근 가능한 이동 조작으로 탐색할 수 있게 만든 연구용 프로토타입입니다.

research.google
#service-design#multimodal#travel-hospitality#llm
Introducing ChatGPT Atlas
Article2025년 10월 21일

Introducing ChatGPT Atlas

챗지피티 아틀라스는 웹 탐색 맥락을 이해하고 기억하며 사용자를 대신해 작업까지 수행하도록 챗지피티를 중심에 둔 새 웹 브라우저다.

openai.com
#privacy-design#agent-memory#agent-routing#retrieval-index
Streaming datasets: 100x More Efficient
Article2025년 10월 21일

Streaming datasets: 100x More Efficient

허깅페이스는 데이터 파일 목록의 공유 캐시, 요청 최적화, Parquet 사전 가져오기와 버퍼 조정을 통해 대규모 데이터셋 스트리밍의 시작 요청을 최대 100분의 1로 줄이고 처리량을 최대 2배로 높였다.

huggingface.co
#service-design#agent-routing#llm#semiconductors
Solving virtual machine puzzles: How AI is optimizing cloud computing
Article2025년 10월 17일

Solving virtual machine puzzles: How AI is optimizing cloud computing

Google 연구진은 VM 수명 예측을 한 번에 끝내지 않고 계속 갱신하는 LAVA 계열 스케줄링 기법으로 대규모 데이터센터의 자원 배치 효율과 운영 안정성을 높이는 방법을 제시했다.

research.google
#privacy-design#agent-memory#context-compression#retrieval-index
XR Blocks: Accelerating AI + XR innovation
Article2025년 10월 9일

XR Blocks: Accelerating AI + XR innovation

엑스알 블록스는 인공지능과 확장현실 앱의 인식·상호작용·렌더링 구현 부담을 낮춰 웹과 안드로이드 확장현실 기기에서 빠른 프로토타이핑을 돕는 오픈소스 프레임워크다.

research.google
#ai-architecture#agent-routing#llm#semiconductors
​​Speech-to-Retrieval (S2R): A new approach to voice search
Article2025년 10월 7일

​​Speech-to-Retrieval (S2R): A new approach to voice search

Google Research는 음성을 먼저 텍스트로 바꾸는 기존 음성 검색의 오류 전파 문제를 줄이기 위해, 발화에서 검색 의도를 직접 벡터화해 문서를 찾는 Speech to Retrieval(S2R) 방식을 도입하고 다국어 평가 데이터셋 SVQ를 공개했다.

research.google
#ai-architecture#agent-memory#retrieval-index#search-advertising
Introducing RTEB: A New Standard for Retrieval Evaluation
Article2025년 10월 1일

Introducing RTEB: A New Standard for Retrieval Evaluation

RTEB는 공개·비공개 데이터셋을 함께 활용해 임베딩 모델의 미지 데이터 검색 성능과 실제 응용 적합성을 공정하게 평가하려는 새로운 검색 벤치마크다.

huggingface.co
#multimodal#agent-memory#change-management#organizational-redesign
More ways to work with your team and tools in ChatGPT
Article2025년 9월 25일

More ways to work with your team and tools in ChatGPT

ChatGPT는 공유 프로젝트, 지능형 커넥터, 강화된 규정 준수·관리 기능을 통해 조직의 협업 맥락을 통합하고 기업 데이터를 안전하게 활용하도록 지원한다.

openai.com
#privacy-design#agent-memory#context-compression#retrieval-index
Democratizing AI Safety with RiskRubric.ai
Article2025년 9월 18일

Democratizing AI Safety with RiskRubric.ai

RiskRubric.ai는 인공지능 모델을 투명성·신뢰성·보안·개인정보 보호·안전성·평판의 여섯 축으로 평가해, 개발자와 조직이 비교 가능한 위험 점수에 근거하여 모델을 선택하고 배포하도록 돕는 공개 표준화 구상이다.

huggingface.co
#privacy-design#agent-routing#llm#semiconductors
Learn Your Way: Reimagining textbooks with generative AI
Article2025년 9월 16일

Learn Your Way: Reimagining textbooks with generative AI

구글 리서치의 Learn Your Way는 생성형 AI로 교과서를 개인화된 다중 형식 학습 경험으로 바꾸고, 초기 연구에서 디지털 리더보다 학습 성과와 유지 점수를 높인 교육 실험이다.

research.google
#multimodal#agent-routing#llm#semiconductors
Fine-tune Any LLM from the Hugging Face Hub with Together AI
Article2025년 9월 10일

Fine-tune Any LLM from the Hugging Face Hub with Together AI

Together AI는 Hugging Face Hub의 호환 LLM을 자사 인프라에서 쉽게 파인튜닝하고 배포·다운로드·허브 재업로드까지 할 수 있는 기능을 발표했다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#retrieval-index
Building more helpful ChatGPT experiences for everyone
Article2025년 9월 2일

Building more helpful ChatGPT experiences for everyone

OpenAI는 정신적·정서적 위기 상황에서 더 적절하게 대응하도록 전문가 협력, 추론 모델 자동 라우팅, 청소년 보호용 부모 관리 기능을 강화한다.

openai.com
#openai#privacy-design#agent-memory#context-compression
🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?
Article2025년 8월 20일

🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?

FilBench는 타갈로그어·필리피노어·세부아노어에 대한 대규모 언어 모델의 문화 지식, 전통적 자연어 처리, 독해, 생성 능력을 체계적으로 측정하고, 지역 특화 학습 데이터와 공개 가중치 모델의 가능성 및 번역 성능의 한계를 보여 주는 평가 모음이다.

huggingface.co
#llm#semiconductors#applications#agent-memory
Securing private data at scale with differentially private partition selection
Article2025년 8월 20일

Securing private data at scale with differentially private partition selection

구글 리서치 연구진은 대규모 사용자 기반 데이터 공개에서 개인 정보 보호를 유지하면서 더 많은 유용한 항목을 선택할 수 있는 차등 프라이버시 파티션 선택 알고리즘 MAD를 제안했다.

research.google
#privacy-design#agent-routing#llm#semiconductors
Finetuning olmOCR to be a faithful OCR-Engine
Article2025년 8월 19일

Finetuning olmOCR to be a faithful OCR-Engine

TNG는 머리말과 꼬리말을 의도적으로 생략하던 olmOCR를 8,000개 문서로 미세조정해, 문서의 논리적 읽기 순서를 유지하면서 업무상 중요한 주변 정보까지 충실하게 추출하는 OCR 모델로 개선했다.

huggingface.co
#multimodal#agent-memory#agent-routing#retrieval-index
We just raised our Series A and shipped /v2
Article2025년 8월 19일

We just raised our Series A and shipped /v2

Firecrawl은 1450만 달러 규모의 시리즈 A 투자 유치와 v2 출시를 알리며, AI가 웹 데이터를 더 빠르고 안정적으로 활용하도록 하는 인프라 기업으로의 확장을 강조했다.

Caleb Peffer
#agent-memory#context-compression#retrieval-index#llm
How to Create Real-Time AI Chat Streaming in Minutes with Convex Components
Article2025년 8월 15일

How to Create Real-Time AI Chat Streaming in Minutes with Convex Components

Convex의 Persistent Text Streaming 컴포넌트를 쓰면 WebSocket이나 SSE를 직접 다루지 않고도 React 채팅 앱에 ChatGPT식 실시간 응답 스트리밍을 빠르게 붙일 수 있다는 튜토리얼입니다.

stack.convex.dev
#ai-architecture#agent-routing#llm#semiconductors
How hard is it to migrate AWAY from Convex?
Article2025년 8월 4일

How hard is it to migrate AWAY from Convex?

저자는 Convex에서 벗어나는 난이도를 직접 검증하기 위해 간단한 Tanstack Start 예제를 기준으로 함수, 클라이언트 호출, 반응형 쿼리, 데이터베이스 이전을 차례로 Tanstack Start와 Drizzle/Postgres로 옮겨 보며 실제 작업량과 복잡도 변화를 살펴본다.

stack.convex.dev
#service-design#ai-architecture#agent-memory#agent-routing
Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio
Article2025년 7월 31일

Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio

Gradio의 MCP 통합을 이용해 웹 탐색 도구와 IDM VTON 가상 피팅 모델을 연결하고, VS Code AI 채팅에서 사용할 수 있는 개인용 AI 쇼핑 도우미를 구현하는 방법을 설명한다.

huggingface.co
#llm#semiconductors#applications#agent-memory
Prefill and Decode for Concurrent Requests - Optimizing LLM Performance
Article2025년 7월 28일

Prefill and Decode for Concurrent Requests - Optimizing LLM Performance

동시 요청을 처리하는 LLM 추론에서는 프리필과 디코드의 계산 특성이 달라, 첫 토큰 지연·토큰 생성 지연·총처리량·GPU 활용률 사이의 균형에 맞춰 배칭과 프리필 청크 크기를 조정해야 한다.

huggingface.co
#agent-memory#agent-routing#retrieval-index#workflow-automation
4M Models Scanned: Protect AI + Hugging Face 6 Months In
Article2025년 7월 27일

4M Models Scanned: Protect AI + Hugging Face 6 Months In

Protect AI와 Hugging Face의 6개월 파트너십은 Guardian 스캔으로 447만 개 모델 버전을 검사하고 35.2만 건의 unsafe/suspicious 이슈를 찾아, 공개 모델 사용자가 보안 위험을 더 명확히 판단하도록 돕고 있다.

huggingface.co
#service-design#llm#semiconductors#applications
이전1…678910118 / 11다음