Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-memory
Tag570건YouTube 21Article 549

#agent-memory

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#retrieval-index공동문서 265 · 연관도 68%#context-compression공동문서 300 · 연관도 61%#applications공동문서 453 · 연관도 56%#semiconductors공동문서 475 · 연관도 56%#llm공동문서 489 · 연관도 55%#agent-routing공동문서 210 · 연관도 37%#ai-architecture공동문서 161 · 연관도 29%#agent-deployment공동문서 103 · 연관도 23%#service-design공동문서 96 · 연관도 21%#multimodal공동문서 68 · 연관도 20%
Agentic Engineering: How Swarms of AI Agents Are Redefining Software Engineering
Article2026년 6월 25일

Agentic Engineering: How Swarms of AI Agents Are Redefining Software Engineering

이 글은 AI 코딩 도구를 넘어, 역할·기억·관측성을 공유하는 다중 에이전트가 소프트웨어 전달 전 과정을 조율하는 ‘에이전틱 엔지니어링’의 구조와 파일럿 결과를 설명한다.

langchain.com
#agent-swarms#ai-architecture#agent-memory#agent-routing
Amazon ups India bet with fresh $13B AI infrastructure investment
Article2026년 6월 25일

Amazon ups India bet with fresh $13B AI infrastructure investment

아마존은 2030년까지 인도에서 AI·클라우드 기반을 확대하기 위해 130억 달러를 추가 투자하고, 동시에 현지 물류·퀵커머스 확장에도 속도를 내고 있다.

Jagmeet Singh
#service-design#llm#semiconductors#applications
British Police Built a Sprawling Crime-Prediction Machine. Some Results Couldn’t Be Trusted
Article2026년 6월 25일

British Police Built a Sprawling Crime-Prediction Machine. Some Results Couldn’t Be Trusted

WIRED 조사에 따르면 영국 브리스틀 지역 경찰과 시의회는 민감한 공공 데이터를 결합해 대규모 예측 치안·위험 점수 시스템을 만들었지만, 일부 모델은 신뢰성·투명성 문제로 폐기되거나 비판을 받았다.

wired.com
#privacy-design#service-design#travel-hospitality#llm
British Police Built a Sprawling Crime-Prediction Machine. Some Results Couldn’t Be Trusted
Article2026년 6월 25일

British Police Built a Sprawling Crime-Prediction Machine. Some Results Couldn’t Be Trusted

WIRED 조사에 따르면 영국 브리스틀 지역 경찰과 시의회는 민감한 공공 데이터를 결합해 대규모 예측 치안·위험 점수 시스템을 만들었지만, 일부 모델은 신뢰성·투명성 문제로 폐기되거나 비판을 받았다.

wired.com
#privacy-design#service-design#travel-hospitality#llm
Building agentic AI applications with a modern data mesh strategy on AWS
Article2026년 6월 25일

Building agentic AI applications with a modern data mesh strategy on AWS

이 글은 RAG의 단일 검색 지점 통제를 넘어, 에이전트형 AI가 스키마 탐색·SQL 생성·쿼리 실행·응답 합성까지 수행하는 전 과정에 세밀한 권한 통제를 적용하기 위한 AWS 기반 서버리스 데이터 메시 아키텍처를 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#context-compression
How we built saga rollbacks for Cloudflare Workflows
Article2026년 6월 25일

How we built saga rollbacks for Cloudflare Workflows

Cloudflare Workflows는 다단계 작업 실패 시 각 단계 안에 선언한 보상 로직을 역순으로 실행하는 saga rollback을 도입해, 내구성 있는 워크플로에서 부분 완료 상태를 더 명확하게 되돌릴 수 있게 했다.

@wishee0
#agent-routing#workflow-automation#travel-hospitality#llm
Optimize model training on Amazon SageMaker AI with NVIDIA Blackwell
Article2026년 6월 25일

Optimize model training on Amazon SageMaker AI with NVIDIA Blackwell

이 글은 Amazon SageMaker AI의 P6 B200 인스턴스와 NVIDIA Blackwell GPU를 활용해 대규모 모델 학습에서 배치 크기, 시퀀스 길이, 샤딩, 정밀도 형식, 활성화 체크포인팅을 어떻게 조정해야 하는지 설명한다.

aws.amazon.com
#nvidia#service-design#ai-architecture#agent-memory
Optimizing cloud economics with linear elastic caching
Article2026년 6월 25일

Optimizing cloud economics with linear elastic caching

선형 탄력 캐싱은 캐시 메모리 비용과 캐시 미스 비용을 함께 최적화하기 위해 페이지 보존 시간을 스키 대여 문제로 모델링하고, 가벼운 학습 기반 TTL 예측으로 고정 크기 캐시보다 낮은 총소유비용을 달성하려는 접근이다.

research.google
#resort-experience#privacy-design#service-design#agent-memory
Repositioning retail for the AI era
Article2026년 6월 25일

Repositioning retail for the AI era

Macy’s는 소매업에서 인공지능을 겉으로 드러나는 기능보다 검색, 재고, 운영, 개발 의사결정에 내재화하는 ‘AI first’ 전략으로 재편하고 있다.

technologyreview.com
#agent-deployment#agent-routing#llm#semiconductors
Build self-service AWS Health analytics to find actionable health insights with AI agents powered by Amazon Bedrock
Article2026년 6월 25일

Build self-service AWS Health analytics to find actionable health insights with AI agents powered by Amazon Bedrock

이 글은 여러 AWS 계정에 흩어진 AWS Health 이벤트를 Chaplin이라는 오픈소스 MCP 기반 AI 에이전트 시스템으로 수집·분류·분석해 운영팀이 자연어로 즉시 실행 가능한 인사이트를 얻는 방법을 설명합니다.

aws.amazon.com
#anthropic#service-design#ai-architecture#agent-memory
The Art of Loop Engineering
Article2026년 6월 25일

The Art of Loop Engineering

이 글은 에이전트를 잘 작동시키려면 단일 모델 성능보다 작업 실행, 검증, 이벤트 구동, 지속 개선을 겹겹이 설계하는 ‘루프 엔지니어링’이 핵심이라고 설명한다.

langchain.com
#ai-architecture#agent-memory#agent-routing#llm-traces
How we built SmithDB’s inverted index for full-text search
Article2026년 6월 25일

How we built SmithDB’s inverted index for full-text search

SmithDB는 수집 시점에 역색인을 함께 만들고, 객체 스토리지 친화적인 레이아웃·병합·쿼리 경로를 통해 대규모 실행 로그의 JSON 필드와 전문 검색을 빠르게 처리한다.

langchain.com
#service-design#agent-memory#retrieval-index#search-advertising
We built SmithDB, the data layer for agent observability
Article2026년 6월 25일

We built SmithDB, the data layer for agent observability

LangSmith는 장기 실행·중첩·멀티모달 에이전트 트레이스를 기존 관측성 저장소로 처리하기 어렵다고 보고, 이를 위해 Rust 기반의 객체 스토리지 지원 분산 데이터 계층인 SmithDB를 구축해 핵심 LangSmith 워크로드에 적용했다.

langchain.com
#service-design#ai-architecture#agent-memory#context-compression
How to Build Memory into AI Agents
Article2026년 6월 24일

How to Build Memory into AI Agents

AI 에이전트의 메모리는 과거 실행에서 얻은 교훈을 장기 컨텍스트로 저장하고 다음 실행에 다시 읽혀 행동을 개선하게 만드는 순환 구조입니다.

langchain.com
#agent-memory#agent-routing#context-compression#retrieval-index
Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
Article2026년 6월 24일

Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel

NVIDIA NeMo AutoModel은 HuggingFace Transformers v5 위에 Expert Parallelism, DeepEP, TransformerEngine 커널을 얹어 MoE 모델 파인튜닝 처리량을 3.4~3.7배 높이고 GPU 메모리를 29~32% 줄이는 것을 목표로 한다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-memory
AI-powered BI with Snowflake and Amazon Quick
Article2026년 6월 24일

AI-powered BI with Snowflake and Amazon Quick

이 글은 Snowflake semantic view를 공통 의미 계층으로 삼아 Cortex Analyst와 Amazon Quick Sight 대시보드가 동일한 비즈니스 정의를 사용하도록 연결하는 실습 절차를 설명합니다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#agent-routing
Cerebras stock plunges after earnings as CEO says margin outlook was misunderstood
Article2026년 6월 24일

Cerebras stock plunges after earnings as CEO says margin outlook was misunderstood

Cerebras는 예상보다 좋은 1분기 실적을 냈지만, 올해 핵심 사업의 매출총이익률 전망이 1분기보다 낮아지면서 주가가 약 20% 급락했다.

Aisha Malik
#anthropic#privacy-design#service-design#semiconductors
Companies are scrambling to stop employees from maxing out AI budgets with small tasks
Article2026년 6월 24일

Companies are scrambling to stop employees from maxing out AI budgets with small tasks

기업들이 직원들의 사소한 AI 사용까지 토큰 비용을 빠르게 소진시키자, 무조건적 AI 사용 장려에서 비용 통제와 가치 검증으로 방향을 바꾸고 있다.

Lucas Ropek
#llm#semiconductors#applications#agent-memory
Former Infosys chief has a new startup that wants to challenge the IT services world
Article2026년 6월 24일

Former Infosys chief has a new startup that wants to challenge the IT services world

전 인포시스 CEO 비샬 시카가 새 스타트업 행텐 시스템스로 AI 기반 기업 소프트웨어 개발·운영 서비스를 내세우며 전통 IT 서비스 산업에 도전하고 있다.

Jagmeet Singh
#anthropic#llm#semiconductors#applications
My Vibe Coding Adventure, The App and the Experience, Ten Takeaways – Stratechery by Ben Thompson
Article2026년 6월 24일

My Vibe Coding Adventure, The App and the Experience, Ten Takeaways – Stratechery by Ben Thompson

제공된 본문은 Ben Thompson의 ‘My Vibe Coding Adventure, The App and the Experience, Ten Takeaways’라는 글의 제목·짧은 소개·사이트 구독 안내를 담고 있으며, 실제 앱 제작 경험이나 열 가지 교훈의 상세 본문은 포함되어 있지 않다.

stratechery.com
#service-design#llm#semiconductors#applications
My Vibe Coding Adventure, The App and the Experience, Ten Takeaways – Stratechery by Ben Thompson
Article2026년 6월 24일

My Vibe Coding Adventure, The App and the Experience, Ten Takeaways – Stratechery by Ben Thompson

제공된 본문은 Ben Thompson의 ‘My Vibe Coding Adventure, The App and the Experience, Ten Takeaways’라는 글의 제목·짧은 소개·사이트 구독 안내를 담고 있으며, 실제 앱 제작 경험이나 열 가지 교훈의 상세 본문은 포함되어 있지 않다.

stratechery.com
#service-design#llm#semiconductors#applications
NVIDIA and AWS Collaborate to Bring AI to Production at Scale
Article2026년 6월 24일

NVIDIA and AWS Collaborate to Bring AI to Production at Scale

NVIDIA와 AWS는 EC2 G7, OpenSearch Serverless의 cuVS 기반 벡터 인덱싱, GB300 훈련 성능 인증을 통해 기업용 AI를 더 낮은 운영 부담으로 대규모 생산 환경에 배포할 수 있게 한다고 설명한다.

Josiah Byers
#nvidia#ai-architecture#agent-memory#agent-routing
OpenAI unveils its first custom chip, built by Broadcom
Article2026년 6월 24일

OpenAI unveils its first custom chip, built by Broadcom

OpenAI는 Broadcom과 함께 만든 첫 맞춤형 추론 칩 ‘Jalapeño’를 공개하며, 추론 비용과 전력 효율을 낮추기 위한 인프라 내재화 전략을 강조했습니다.

Russell Brandom
#broadcom#nvidia#openai#ai-architecture
The emergence of the web data infrastructure layer for AI
Article2026년 6월 24일

The emergence of the web data infrastructure layer for AI

AI의 다음 병목은 모델 크기가 아니라, 최신·관련성·신뢰성을 갖춘 웹 데이터를 실시간으로 발견하고 구조화해 공급하는 인프라 계층에 있다.

technologyreview.com
#privacy-design#ai-architecture#agent-memory#context-compression
이전1…34567…245 / 24다음