Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-memory
Tag543건YouTube 19Article 524

#agent-memory

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#retrieval-index공동문서 248 · 연관도 66%#context-compression공동문서 286 · 연관도 60%#semiconductors공동문서 457 · 연관도 56%#applications공동문서 432 · 연관도 56%#llm공동문서 468 · 연관도 55%#agent-routing공동문서 201 · 연관도 37%#ai-architecture공동문서 152 · 연관도 30%#agent-deployment공동문서 98 · 연관도 23%#vision-language-models공동문서 64 · 연관도 20%#multimodal공동문서 66 · 연관도 20%
How Google’s AI can help transform health professions education
Article2025년 8월 27일

How Google’s AI can help transform health professions education

구글은 의료 인력 부족 문제를 배경으로, 학습자 중심 설계와 정량 평가를 통해 Google AI와 LearnLM이 보건의료 전문직 교육에서 개인화된 튜터 역할을 할 가능성을 탐색했다.

research.google
#search-advertising#zero-click-search#llm#semiconductors
A scalable framework for evaluating health language models
Article2025년 8월 26일

A scalable framework for evaluating health language models

Google Research는 건강 언어모델 평가를 세분화된 예/아니오 기준으로 바꾸고 관련 문항만 적응적으로 선별해, 평가 시간은 줄이면서 평가자 간 일치도와 품질 차이 감지 능력을 높이는 방법을 제안했다.

research.google
#service-design#llm#semiconductors#applications
Accelerating life sciences research
Article2025년 8월 22일

Accelerating life sciences research

오픈AI와 레트로 바이오사이언시스는 단백질 공학 특화 모델인 GPT‑4b 마이크로로 야마나카 인자 변형체를 설계해 줄기세포 재프로그래밍 표지자 발현을 야생형 대비 50배 이상 높이고, 다양한 세포·공여자·전달 방식에서 완전한 다능성과 유전체 안정성을 확인했다.

openai.com
#openai#privacy-design#llm#semiconductors
Blue J’s approach for scaling fast in complex, regulated domains
Article2025년 8월 21일

Blue J’s approach for scaling fast in complex, regulated domains

Blue J는 세무 전문성, GPT‑4.1 기반 검색증강생성, 체계적인 사용자 피드백과 평가 체계를 결합해 복잡하고 규제가 엄격한 세무 조사 서비스를 빠르게 확장했다.

openai.com
#agent-deployment#llm#semiconductors#applications
🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?
Article2025년 8월 20일

🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?

FilBench는 타갈로그어·필리피노어·세부아노어에 대한 대규모 언어 모델의 문화 지식, 전통적 자연어 처리, 독해, 생성 능력을 체계적으로 측정하고, 지역 특화 학습 데이터와 공개 가중치 모델의 가능성 및 번역 성능의 한계를 보여 주는 평가 모음이다.

huggingface.co
#llm#semiconductors#applications#agent-memory
Securing private data at scale with differentially private partition selection
Article2025년 8월 20일

Securing private data at scale with differentially private partition selection

구글 리서치 연구진은 대규모 사용자 기반 데이터 공개에서 개인 정보 보호를 유지하면서 더 많은 유용한 항목을 선택할 수 있는 차등 프라이버시 파티션 선택 알고리즘 MAD를 제안했다.

research.google
#privacy-design#agent-routing#llm#semiconductors
Finetuning olmOCR to be a faithful OCR-Engine
Article2025년 8월 19일

Finetuning olmOCR to be a faithful OCR-Engine

TNG는 머리말과 꼬리말을 의도적으로 생략하던 olmOCR를 8,000개 문서로 미세조정해, 문서의 논리적 읽기 순서를 유지하면서 업무상 중요한 주변 정보까지 충실하게 추출하는 OCR 모델로 개선했다.

huggingface.co
#multimodal#agent-memory#agent-routing#retrieval-index
We just raised our Series A and shipped /v2
Article2025년 8월 19일

We just raised our Series A and shipped /v2

Firecrawl은 1450만 달러 규모의 시리즈 A 투자 유치와 v2 출시를 알리며, AI가 웹 데이터를 더 빠르고 안정적으로 활용하도록 하는 인프라 기업으로의 확장을 강조했다.

Caleb Peffer
#agent-memory#context-compression#retrieval-index#llm
How Engage Together Uses Firecrawl to Map Anti-Trafficking Resources at Scale
Article2025년 8월 17일

How Engage Together Uses Firecrawl to Map Anti-Trafficking Resources at Scale

Engage Together는 Firecrawl의 /extract API를 활용해 지역별 인신매매 방지 프로그램과 자원을 자동으로 수집하며, 과거 지역마다 다수의 인턴이 맡던 수작업 조사 병목을 대규모 데이터 파이프라인으로 전환했다.

Eric Ciarla
#agent-routing#workflow-automation#llm#semiconductors
Vision Language Model Alignment in TRL ⚡️
Article2025년 8월 16일

Vision Language Model Alignment in TRL ⚡️

TRL은 비전 언어 모델 정렬을 기존 SFT·DPO에서 MPO·GRPO·GSPO와 RLOO·Online DPO까지 확장해, 멀티모달 선호 학습과 강화학습을 더 유연하게 적용할 수 있도록 지원한다.

huggingface.co
#multimodal#capex-cycle#llm#semiconductors
How to Create Real-Time AI Chat Streaming in Minutes with Convex Components
Article2025년 8월 15일

How to Create Real-Time AI Chat Streaming in Minutes with Convex Components

Convex의 Persistent Text Streaming 컴포넌트를 쓰면 WebSocket이나 SSE를 직접 다루지 않고도 React 채팅 앱에 ChatGPT식 실시간 응답 스트리밍을 빠르게 붙일 수 있다는 튜토리얼입니다.

stack.convex.dev
#ai-architecture#agent-routing#llm#semiconductors
Beyond billion-parameter burdens: Unlocking data synthesis with a conditional generator
Article2025년 8월 14일

Beyond billion-parameter burdens: Unlocking data synthesis with a conditional generator

Google Research는 거대 LLM을 비공개 데이터에 직접 미세조정하지 않고도, 1억4000만 매개변수 조건부 생성기와 주제 분포 매칭을 통해 차등 프라이버시 합성 텍스트 데이터를 만드는 CTCL 프레임워크를 제안했다.

research.google
#privacy-design#context-compression#prompt-library#llm
Arm & ExecuTorch 0.7: Bringing Generative AI to the masses
Article2025년 8월 13일

Arm & ExecuTorch 0.7: Bringing Generative AI to the masses

ExecuTorch 0.7은 KleidiAI를 기본 활성화하고 널리 보급된 Arm의 SDOT 명령어를 활용해, 최신 스마트폰뿐 아니라 구형 안드로이드 기기와 라즈베리 파이 5에서도 실용적인 온디바이스 생성형 인공지능을 지원한다.

huggingface.co
#privacy-design#ai-architecture#agent-routing#llm
TextQuests: How Good are LLMs at Text-Based Video Games?
Article2025년 8월 13일

TextQuests: How Good are LLMs at Text-Based Video Games?

TextQuests는 25개의 고전 텍스트 어드벤처 게임을 통해 LLM 에이전트의 장기 문맥 추론, 탐색 학습, 공간 이해, 행동 효율성과 유해 행동 경향을 평가하는 벤치마크다.

huggingface.co
#token-efficiency#llm#semiconductors#applications
Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training
Article2025년 8월 12일

Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training

Accelerate와 Axolotl은 데이터·완전 샤딩 데이터·텐서·컨텍스트 병렬화를 조합해 대규모 모델의 메모리 사용량, 계산량, 장치 간 통신 비용을 균형 있게 설계하도록 지원한다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#capex-cycle
Announcing NeurIPS 2025 E2LM Competition: Early Training Evaluation of Language Models
Article2025년 8월 5일

Announcing NeurIPS 2025 E2LM Competition: Early Training Evaluation of Language Models

NeurIPS 2025 E2LM Competition은 LLM 초기 학습 단계에서 과학 지식과 추론 신호를 더 잘 포착하는 벤치마크를 함께 만들기 위한 대회다.

huggingface.co
#e2lm-competition#hugging-face#lm-evaluation-harness#llm
Introducing gpt-oss
Article2025년 8월 5일

Introducing gpt-oss

오픈AI는 높은 추론·도구 사용 성능과 효율적인 로컬 실행을 결합한 아파치 2.0 기반 오픈 웨이트 모델 gpt oss 120b와 gpt oss 20b를 공개했다.

openai.com
#ai-architecture#multimodal#agent-memory#agent-routing
How hard is it to migrate AWAY from Convex?
Article2025년 8월 4일

How hard is it to migrate AWAY from Convex?

저자는 Convex에서 벗어나는 난이도를 직접 검증하기 위해 간단한 Tanstack Start 예제를 기준으로 함수, 클라이언트 호출, 반응형 쿼리, 데이터베이스 이전을 차례로 Tanstack Start와 Drizzle/Postgres로 옮겨 보며 실제 작업량과 복잡도 변화를 살펴본다.

stack.convex.dev
#service-design#ai-architecture#agent-memory#agent-routing
Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio
Article2025년 7월 31일

Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio

Gradio의 MCP 통합을 이용해 웹 탐색 도구와 IDM VTON 가상 피팅 모델을 연결하고, VS Code AI 채팅에서 사용할 수 있는 개인용 AI 쇼핑 도우미를 구현하는 방법을 설명한다.

huggingface.co
#llm#semiconductors#applications#agent-memory
Benchmarking Language Model Performance on 5th Gen Xeon at GCP
Article2025년 7월 29일

Benchmarking Language Model Performance on 5th Gen Xeon at GCP

Google Cloud의 5세대 Xeon 기반 C4 인스턴스는 3세대 Xeon 기반 N2보다 텍스트 임베딩과 텍스트 생성에서 큰 처리량 및 비용 효율 우위를 보이며, 경량 에이전틱 AI를 CPU만으로 배포할 가능성을 보여준다.

huggingface.co
#llm#semiconductors#applications#long-context
Prefill and Decode for Concurrent Requests - Optimizing LLM Performance
Article2025년 7월 28일

Prefill and Decode for Concurrent Requests - Optimizing LLM Performance

동시 요청을 처리하는 LLM 추론에서는 프리필과 디코드의 계산 특성이 달라, 첫 토큰 지연·토큰 생성 지연·총처리량·GPU 활용률 사이의 균형에 맞춰 배칭과 프리필 청크 크기를 조정해야 한다.

huggingface.co
#agent-memory#agent-routing#retrieval-index#workflow-automation
SensorLM: Learning the language of wearable sensors
Article2025년 7월 28일

SensorLM: Learning the language of wearable sensors

센서엘엠은 5,970만 시간의 웨어러블 센서 데이터와 자동 생성 설명문을 학습해 신체 신호를 자연어로 해석하고 검색·분류·설명하는 센서 언어 기반 모델군이다.

research.google
#ai-architecture#multimodal#llm#semiconductors
4M Models Scanned: Protect AI + Hugging Face 6 Months In
Article2025년 7월 27일

4M Models Scanned: Protect AI + Hugging Face 6 Months In

Protect AI와 Hugging Face의 6개월 파트너십은 Guardian 스캔으로 447만 개 모델 버전을 검사하고 35.2만 건의 unsafe/suspicious 이슈를 찾아, 공개 모델 사용자가 보안 위험을 더 명확히 판단하도록 돕고 있다.

huggingface.co
#service-design#llm#semiconductors#applications
Codex is Open Sourcing AI models
Article2025년 7월 26일

Codex is Open Sourcing AI models

이 글은 Codex가 Hugging Face Skills를 활용해 데이터 검증, 모델 파인튜닝, 학습 모니터링, 평가, 보고서 갱신, Hub 배포까지 이어지는 오픈소스 모델 실험을 수행하는 방법을 설명한다.

huggingface.co
#agent-deployment#agent-routing#ai-safety#llm
이전1…1617181920…2318 / 23다음