Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-memory
Tag543건YouTube 19Article 524

#agent-memory

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#retrieval-index공동문서 248 · 연관도 66%#context-compression공동문서 286 · 연관도 60%#semiconductors공동문서 457 · 연관도 56%#applications공동문서 432 · 연관도 56%#llm공동문서 468 · 연관도 55%#agent-routing공동문서 201 · 연관도 37%#ai-architecture공동문서 152 · 연관도 30%#agent-deployment공동문서 98 · 연관도 23%#vision-language-models공동문서 64 · 연관도 20%#multimodal공동문서 66 · 연관도 20%
Five Big Improvements to Gradio MCP Servers
Article2026년 4월 6일

Five Big Improvements to Gradio MCP Servers

Gradio 5.38.0은 로컬 파일 전달, 실시간 진행 알림, OpenAPI 변환, 인증 헤더 처리, 도구 설명 맞춤화로 MCP 서버의 개발·연결 경험을 개선했다.

huggingface.co
#agent-routing#llm#semiconductors#applications
Evaluating alignment of behavioral dispositions in LLMs
Article2026년 4월 3일

Evaluating alignment of behavioral dispositions in LLMs

Google Research는 심리학 설문을 실제 조언 상황의 상황판단검사로 바꾸어 25개 LLM의 행동 성향이 인간 합의와 얼마나 맞는지 평가했고, 큰 모델도 낮은 합의 상황에서는 인간 의견의 분포와 모호성을 충분히 반영하지 못한다고 보고했다.

research.google
#anthropic#llm#semiconductors#applications
Fragments: April 2
Article2026년 4월 2일

Fragments: April 2

마틴 파울러는 LLM 시대의 핵심 문제가 코드 생산 자체보다 시스템 이해, 의도 보존, 검증, 그리고 인간과 AI가 함께 사용할 언어의 설계로 이동하고 있다고 정리한다.

martinfowler.com
#agent-memory#energy-security#inflation-risk#retrieval-index
Any Custom Frontend with Gradio's Backend
Article2026년 4월 1일

Any Custom Frontend with Gradio's Backend

그라디오 서버는 리액트·스벨트·순수 HTML 같은 사용자 정의 프런트엔드를 유지하면서도 그라디오의 요청 대기열, 동시성 제어, 스트리밍, 클라이언트 호환성 및 허깅페이스 스페이스 실행 환경을 활용하게 해준다.

huggingface.co
#ai-infrastructure#capex-cycle#llm#semiconductors
Inside VAKRA: Reasoning, Tool Use, and Failure Modes of Agents
Article2026년 3월 31일

Inside VAKRA: Reasoning, Tool Use, and Failure Modes of Agents

VAKRA는 기업형 환경에서 에이전트가 API, 문서, 대화 맥락, 정책 제약을 넘나들며 다단계 추론과 도구 사용을 실제 실행 궤적으로 수행할 수 있는지 평가하는 실행 중심 벤치마크다.

huggingface.co
#vakra#hugging-face#ibm-research#rest-bird
Safeguarding cryptocurrency by disclosing quantum vulnerabilities responsibly
Article2026년 3월 31일

Safeguarding cryptocurrency by disclosing quantum vulnerabilities responsibly

구글 퀀텀 AI는 향후 양자컴퓨터가 암호화폐의 타원곡선 암호를 기존 예상보다 적은 자원으로 깰 수 있음을 제시하며, 세부 공격 경로는 숨기고 검증은 가능한 방식으로 책임 있는 취약점 공개와 포스트양자암호 전환을 촉구했다.

research.google
#privacy-design#llm#semiconductors#applications
Train AI models with Unsloth and Hugging Face Jobs for FREE
Article2026년 3월 30일

Train AI models with Unsloth and Hugging Face Jobs for FREE

이 글은 Unsloth와 Hugging Face Jobs를 이용해 소형 언어 모델을 빠르고 저렴하게 파인튜닝하는 방법을, CLI 실행과 코딩 에이전트용 스킬 설치 흐름까지 함께 설명한다.

huggingface.co
#ai-infrastructure#capex-cycle#llm#semiconductors
Helping disaster response teams turn AI into action across Asia
Article2026년 3월 29일

Helping disaster response teams turn AI into action across Asia

아시아 13개국 재난관리 전문가 50명이 방콕에 모여, 재난 대응 현장의 정보 수집·상황 보고·수요 평가·대국민 소통에 AI를 실질적으로 적용하는 방법을 공동으로 모색했다.

openai.com
#agent-deployment#agent-routing#semiconductors#applications
Firecrawl + n8n: Bring Real-Time Web Data Into Your AI Workflows
Article2026년 3월 26일

Firecrawl + n8n: Bring Real-Time Web Data Into Your AI Workflows

Firecrawl과 n8n의 네이티브 통합은 웹페이지를 LLM이 바로 쓸 수 있는 정제 데이터로 바꾸고, 이를 AI 워크플로·RAG·리드 강화·시장 조사 자동화에 연결하도록 해준다.

Nicolas Camara
#agent-memory#agent-routing#context-compression#retrieval-index
Introducing /interact — Scrape and interact with a web page
Article2026년 3월 25일

Introducing /interact — Scrape and interact with a web page

Firecrawl의 /interact는 스크레이프한 웹페이지 세션을 그대로 살아 있는 브라우저로 전환해 클릭, 입력, 이동, 동적 데이터 추출을 수행하게 하는 새 엔드포인트다.

Eric Ciarla
#agent-memory#agent-routing#context-compression#prompt-library
A New Framework for Evaluating Voice Agents (EVA)
Article2026년 3월 24일

A New Framework for Evaluating Voice Agents (EVA)

EVA는 음성 에이전트를 실제 다중 턴 음성 대화로 평가하며, 정확도와 사용자 경험을 함께 측정해 기존 벤치마크가 놓치던 상충 관계와 실패 양상을 드러내는 평가 프레임워크다.

huggingface.co
#ai-architecture#agent-deployment#agent-routing#llm
bliki: Architecture Decision Record
Article2026년 3월 24일

bliki: Architecture Decision Record

마틴 파울러는 ADR을 제품이나 생태계에 중요한 단일 아키텍처 결정을 짧게 기록해, 결정의 맥락·근거·영향을 남기고 이후 변경은 새 기록으로 연결하는 실천이라고 설명한다.

martinfowler.com
#ai-architecture#semiconductors#applications#compute
Helping developers build safer AI experiences for teens
Article2026년 3월 24일

Helping developers build safer AI experiences for teens

오픈에이아이는 청소년에게 적합한 인공지능 서비스를 구축할 수 있도록 실제 분류 시스템에 바로 적용하고 조정할 수 있는 프롬프트형 안전 정책을 공개했다.

openai.com
#agent-routing#context-compression#prompt-library#llm
Mapping the modern world: How S2Vec learns the language of our cities
Article2026년 3월 24일

Mapping the modern world: How S2Vec learns the language of our cities

구글 리서치의 S2Vec은 도로·건물·상점 같은 구축환경 데이터를 S2 셀 기반 이미지처럼 변환하고 자기지도 학습으로 임베딩해 전 세계 사회경제·환경 패턴 예측에 활용하는 지리 AI 프레임워크다.

research.google
#privacy-design#multimodal#llm#semiconductors
Powering Product Discovery in ChatGPT
Article2026년 3월 24일

Powering Product Discovery in ChatGPT

OpenAI는 ChatGPT 안에서 제품을 탐색하고 비교해 구매 결정을 돕는 시각적 쇼핑 경험을 강화하며, 이를 위해 ACP를 제품 발견 영역으로 확장한다고 설명한다.

openai.com
#resort-experience#agent-deployment#semiconductors#applications
TurboQuant: Redefining AI efficiency with extreme compression
Article2026년 3월 24일

TurboQuant: Redefining AI efficiency with extreme compression

TurboQuant는 QJL과 PolarQuant를 결합해 벡터 양자화의 메모리 오버헤드를 줄이고, KV 캐시 압축과 고차원 벡터 검색에서 정확도 손실 없이 큰 압축·속도 향상을 보인 Google Research의 알고리즘입니다.

research.google
#privacy-design#agent-memory#context-compression#retrieval-index
College Talent
Article2026년 3월 20일

College Talent

a16z College Talent Network는 컴퓨터공학 및 유사 분야의 대학생·대학원생에게 장기적인 멘토링, 커리어 조언, 스타트업 생태계 기회 연결을 제공하는 프로그램입니다.

a16z.com
#service-design#change-management#organizational-redesign#semiconductors
GPT 5.4 is a big step for Codex
Article2026년 3월 18일

GPT 5.4 is a big step for Codex

GPT 5.4는 Codex에서 정확성·사용성·속도·비용 체감 모두를 개선하며 OpenAI 에이전트 경험을 크게 끌어올렸지만, 저자는 여전히 Claude의 따뜻함과 의도 이해를 더 즐긴다.

Nathan Lambert
#privacy-design#ai-safety#llm#semiconductors
Holotron-12B - High Throughput Computer Use Agent
Article2026년 3월 17일

Holotron-12B - High Throughput Computer Use Agent

홀로트론 12B는 하이브리드 상태공간모델과 어텐션 구조를 기반으로 긴 문맥과 다중 이미지를 효율적으로 처리하면서 높은 컴퓨터 사용 성능과 추론 처리량을 달성한 120억 매개변수 멀티모달 에이전트 모델이다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-memory
OpenAI Japan announces Japan Teen Safety Blueprint to put teen safety first
Article2026년 3월 17일

OpenAI Japan announces Japan Teen Safety Blueprint to put teen safety first

오픈AI 재팬은 청소년의 안전과 복지를 편의성·개인정보 보호·이용 자유보다 우선하는 생성형 AI 보호 체계인 ‘일본 청소년 안전 청사진’을 발표했다.

openai.com
#openai#privacy-design#semiconductors#applications
Testing LLMs on superconductivity research questions
Article2026년 3월 16일

Testing LLMs on superconductivity research questions

Google Research와 협력 연구진은 고온 초전도 연구 질문을 사례로 여섯 LLM을 전문가가 평가한 결과, 큐레이션된 과학 문헌에 기반한 NotebookLM과 맞춤형 RAG 시스템이 가장 높은 성과를 보였다고 밝혔다.

research.google
#search-advertising#zero-click-search#llm#semiconductors
Introducing Groundsource: Turning news reports into data with Gemini
Article2026년 3월 12일

Introducing Groundsource: Turning news reports into data with Gemini

Google Research는 Gemini로 전 세계 뉴스 보도를 분석해 도시 돌발홍수 260만 건의 구조화 데이터셋을 만든 Groundsource를 공개하고, 이를 예측·연구 기반으로 활용한다고 밝혔다.

research.google
#llm#semiconductors#applications#agent-memory
Protecting cities with AI-driven flash flood forecasting
Article2026년 3월 12일

Protecting cities with AI-driven flash flood forecasting

구글 리서치는 뉴스 기반 Groundsource 데이터와 AI 모델을 활용해 도시 돌발홍수를 최대 24시간 전 예측하는 기능을 Flood Hub에 확대하며, 조기경보 격차가 큰 지역의 기후 회복력 강화를 목표로 한다.

research.google
#service-design#ai-architecture#llm#semiconductors
Exploring the feasibility of conversational diagnostic AI in a real-world clinical study
Article2026년 3월 11일

Exploring the feasibility of conversational diagnostic AI in a real-world clinical study

구글 리서치·구글 딥마인드와 Beth Israel Deaconess Medical Center의 전향적 단일기관 연구는 대화형 의료 AI AMIE가 실제 일차진료 방문 전 병력 청취를 감독하에 수행하는 것이 초기 단계에서 실행 가능하고 안전하게 수용될 수 있음을 보고했다.

research.google
#multimodal#agent-routing#semiconductors#vision-language-models
이전1…1011121314…2312 / 23다음