Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Built Technologies builds an AI-powered document intelligence solution on AWS to power agents across real estate finance
Article2026년 7월 15일

Built Technologies builds an AI-powered document intelligence solution on AWS to power agents across real estate finance

Built Technologies는 복잡한 부동산 금융 문서를 분류·분할·추출·평가·추론하는 재사용형 문서 지능 엔진을 구축해 여러 에이전트형 제품의 공통 기반으로 활용하고 있다.

aws.amazon.com
#amazon-bedrock#built-technologies#amazon-web-services#construction-lending
Welcome Inkling by Thinking Machines
Article2026년 7월 15일

Welcome Inkling by Thinking Machines

Inkling은 텍스트·이미지·오디오를 기본 입력으로 처리하고 1M 문맥과 멀티모달 추론을 지원하는 Thinking Machines의 약 1T 규모 공개 MoE 모델이다.

huggingface.co
#inkling#transformers#hugging-face#thinking-machines
Multi-agent social intelligence with Strands Agents and Amazon Bedrock
Article2026년 7월 14일

Multi-agent social intelligence with Strands Agents and Amazon Bedrock

Thrad.ai는 여러 온라인 소스의 구매 신호를 전문 에이전트가 수집·교차 분석하고, 점수화된 잠재 고객에게 개인화 이메일을 생성하는 다중 에이전트 사회적 인텔리전스 시스템을 구축했다.

aws.amazon.com
#amazon-bedrock#strands-agents#thrad-ai#graph-swarm-tradeoff
Scaling medical content review at Flo Health with Amazon Bedrock – Part 2
Article2026년 7월 14일

Scaling medical content review at Flo Health with Amazon Bedrock – Part 2

Flo Health는 의료 전문가의 최종 통제를 유지하면서 전문화된 AI 평가, 신뢰할 수 있는 자료 검색, 자동 재검증을 결합해 의료 콘텐츠 검토 시간을 60% 줄이고 팀 증원 없이 처리량을 3배로 높였다.

aws.amazon.com
#contentful#amazon-bedrock#flo-health#claude-model-family
Building an agentic AI solution at Bluesight with Amazon Bedrock
Article2026년 7월 13일

Building an agentic AI solution at Bluesight with Amazon Bedrock

블루사이트는 병원 규정 준수 업무를 자동화하기 위해 단일 제품용 인공지능 시제품을 구축한 뒤, 이를 여러 의료 규정 준수 제품의 데이터를 함께 다루는 통합 에이전트형 인공지능 솔루션 프리즘으로 확장했다.

aws.amazon.com
#privacy-design#service-design#ai-architecture#agent-routing
Implement on-behalf-of token exchange for multi-tenant agents with Amazon Bedrock AgentCore Gateway
Article2026년 7월 13일

Implement on-behalf-of token exchange for multi-tenant agents with Amazon Bedrock AgentCore Gateway

다중 테넌트 에이전트가 사용자의 신원을 보존하면서도 각 하위 서비스에만 유효한 토큰을 사용하도록, 아마존 베드록 에이전트코어 게이트웨이와 아이덴티티로 대리 토큰 교환을 구현하는 방법을 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-routing#api-api
Launching UI for generative AI inference recommendations in Amazon SageMaker AI
Article2026년 7월 13일

Launching UI for generative AI inference recommendations in Amazon SageMaker AI

아마존 세이지메이커 AI 스튜디오의 새 추론 추천 사용자 인터페이스는 생성형 인공지능 모델의 워크로드 설정부터 실제 장비 벤치마크, 결과 비교, 운영 엔드포인트 배포까지를 코드 없이 연결합니다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#agent-routing
Otonom Ajanlarda Determinizm ve Sonsuz Döngü Bariyerleri: LangGraph ve Stateful Mimari Analizi
Article2026년 7월 12일

Otonom Ajanlarda Determinizm ve Sonsuz Döngü Bariyerleri: LangGraph ve Stateful Mimari Analizi

운영 환경의 자율 에이전트는 중앙 상태 그래프와 정적 반복 제한, 의미적 정체 감지, 토큰 소비 속도 감시를 결합한 결정론적 통제 계층 안에서 작동해야 한다.

burak ozkan
#privacy-design#ai-architecture#langgraph#llm
Build a semantic layer for agentic AI on AWS with Stardog and Amazon Bedrock AgentCore
Article2026년 7월 10일

Build a semantic layer for agentic AI on AWS with Stardog and Amazon Bedrock AgentCore

신뢰할 수 있는 에이전틱 분석을 위해 Aurora와 Amazon Redshift의 데이터를 이동하지 않고 Stardog 의미 계층으로 통합하고, AgentCore에서 실행되는 AI 에이전트가 일관된 비즈니스 규칙과 권한에 따라 고객 360 질문에 답하도록 구성하는 방법을 설명한다.

aws.amazon.com
#anthropic#service-design#ai-architecture#agent-routing
Deploying quantized models on Amazon SageMaker AI with Unsloth
Article2026년 7월 10일

Deploying quantized models on Amazon SageMaker AI with Unsloth

Unsloth의 동적 양자화와 모델 형식별 배포 원칙을 활용하면 모델 품질 저하를 억제하면서 메모리·비용·시작 시간을 줄이고, Amazon EC2에서 검증한 구성을 Amazon SageMaker AI 등의 운영 환경으로 확장할 수 있다.

aws.amazon.com
#service-design#ai-architecture#multimodal#agent-deployment
Disaggregated prefill and decode for LLM inference on SageMaker HyperPod
Article2026년 7월 10일

Disaggregated prefill and decode for LLM inference on SageMaker HyperPod

긴 프롬프트의 사전 채우기와 토큰 생성을 별도 GPU 풀로 분리하고 KV 캐시를 EFA 기반 RDMA로 전달해, 대규모 LLM 스트리밍 추론의 첫 토큰 시간과 토큰 간 지연을 독립적으로 최적화하는 방법을 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#context-compression
Fine-tune NVIDIA Nemotron 3 models with Amazon SageMaker AI serverless model customization
Article2026년 7월 10일

Fine-tune NVIDIA Nemotron 3 models with Amazon SageMaker AI serverless model customization

Amazon SageMaker AI의 서버리스 모델 맞춤화를 이용하면 인프라를 직접 관리하지 않고도 NVIDIA Nemotron 3 Nano와 Super를 SFT, RLVR, RLAIF 방식으로 기업 데이터와 업무에 특화할 수 있다.

aws.amazon.com
#nvidia#service-design#ai-architecture#capex-cycle
How KTern.AI built agentic AI for SAP on Amazon Bedrock AgentCore
Article2026년 7월 10일

How KTern.AI built agentic AI for SAP on Amazon Bedrock AgentCore

KTern.AI는 SAP 전환용 전문 에이전트의 실행·기억·도구 연결·접근 통제·관찰 기능을 Amazon Bedrock AgentCore에 맡겨 개발 속도와 운영 효율을 높이고, 프로젝트 기간과 수작업 의존도를 줄였다.

aws.amazon.com
#anthropic#service-design#ai-architecture#agent-memory
Profiling in PyTorch (Part 3): Attention is all you profile
Article2026년 7월 10일

Profiling in PyTorch (Part 3): Attention is all you profile

파이토치 프로파일러로 어텐션 구현을 비교한 결과, 제자리 마스킹은 불필요한 메모리 복사를 제거했지만 SDPA 수학 백엔드는 텐서 코어 미사용과 매 호출 마스크 생성으로 인해 단순 구현보다 3.7배 느렸다.

huggingface.co
#ai-architecture#agent-memory#capex-cycle#context-compression
Real-time dental image verification with Amazon SageMaker AI at Henry Schein One
Article2026년 7월 10일

Real-time dental image verification with Amazon SageMaker AI at Henry Schein One

헨리 샤인 원은 치과 엑스레이 촬영 즉시 품질을 판정하는 이미지 베리파이를 구축해 1.4초의 중앙 지연시간과 0.01%의 오류율로 1만 곳 이상의 진료 현장을 지원하고 있다.

aws.amazon.com
#service-design#ai-architecture#agent-routing#ai-infrastructure
Robot Dogs, Teslas, and Rescue Helicopters: The UN AI Summit Was a Lot
Article2026년 7월 10일

Robot Dogs, Teslas, and Rescue Helicopters: The UN AI Summit Was a Lot

유엔의 AI 포 굿 정상회의는 인류 문제 해결이라는 이상을 내세웠지만, 빅테크 의존과 컴퓨팅 격차, 인권의 기술적 집행, 느린 국제 합의라는 현실 속에서 AI의 발전 속도를 따라잡을 수 있는지 되물었다.

Chris Stokel-Walker
#resort-experience#ai-architecture#llm#semiconductors
Scaling agentic workflows with native case management in Amazon Quick Automate
Article2026년 7월 10일

Scaling agentic workflows with native case management in Amazon Quick Automate

Amazon Quick Automate는 대규모 에이전트 업무를 지속적인 사례 단위로 관리해 상태 추적, 병렬 처리, 예외 대응, 사람의 개입과 감사 가능성을 함께 제공한다.

aws.amazon.com
#service-design#ai-architecture#agent-deployment#agent-routing
The Mind’s New Dial: Neural Wearables and the $12 Billion Cognitive Gold Rush...
Article2026년 7월 9일

The Mind’s New Dial: Neural Wearables and the $12 Billion Cognitive Gold Rush...

이 글은 비침습 신경 웨어러블이 뇌를 실시간으로 측정·해석·피드백하는 ‘프로그래밍 가능한 인터페이스’로 바꾸며, 기존 카페인·명상 앱·약물 중심의 둔탁한 인지 관리 시장을 정밀 기술과 소재 공급망 중심의 투자 영역으로 재편하고 있다고 설명한다.

C.D. Lawrence
#privacy-design#ai-architecture#agent-routing#llm
SensorFM: Towards a general intelligence and interface for wearable health data
Article2026년 7월 9일

SensorFM: Towards a general intelligence and interface for wearable health data

SensorFM은 500만 명의 비식별 웨어러블 센서 데이터 1조 분 이상을 자기지도 방식으로 학습해 다양한 건강 예측, 결측 데이터 복원, 적은 라벨을 활용한 적응, 개인 건강 에이전트의 생리학적 근거 제공을 지원하는 범용 파운데이션 모델이다.

research.google
#model-scaling#ai-architecture#multimodal#llm
Tuning the harness, not the model: a Nemotron 3 Ultra playbook
Article2026년 7월 8일

Tuning the harness, not the model: a Nemotron 3 Ultra playbook

모델 가중치와 생성 설정을 그대로 유지한 채 프롬프트·도구 설명·미들웨어를 평가 기반으로 조율해, Nemotron 3 Ultra의 에이전트 성능을 낮은 비용으로 최전선 모델에 근접시킨 실전 사례다.

langchain.com
#service-design#ai-architecture#context-compression#prompt-library
Automatically sort and prioritize your mailboxes by using Amazon Bedrock
Article2026년 7월 8일

Automatically sort and prioritize your mailboxes by using Amazon Bedrock

이 글은 공공 부문 조직이 Amazon Bedrock과 AWS 서비스를 이용해 민원 이메일을 자동 분류·우선순위화·분석하는 참조 아키텍처와 배포 절차를 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-deployment#agent-routing
Building and connecting a production-ready ecommerce MCP server using Amazon Bedrock AgentCore and Mistral AI Studio
Article2026년 7월 8일

Building and connecting a production-ready ecommerce MCP server using Amazon Bedrock AgentCore and Mistral AI Studio

이 글은 FastMCP 기반 전자상거래 MCP 서버를 만들고 Amazon Bedrock AgentCore Runtime, Amazon Cognito, DynamoDB, Mistral AI Vibe와 연결해 인증·데이터 격리·배포까지 갖춘 AI 쇼핑 도우미를 구축하는 과정을 설명합니다.

aws.amazon.com
#privacy-design#service-design#ai-architecture#agent-deployment
Hot French startup ZML releases free product to speed inference across lots of AI chips
Article2026년 7월 8일

Hot French startup ZML releases free product to speed inference across lots of AI chips

프랑스 AI 스타트업 ZML이 여러 종류의 AI 칩에서 오픈소스 대형언어모델 추론을 더 빠르고 유연하게 실행하도록 돕는 무료 제품 ZML/LLMD를 출시했다.

Anna Heim
#nvidia#ai-architecture#ai-infrastructure#capex-cycle
Introducing Claude apps gateway for AWS
Article2026년 7월 8일

Introducing Claude apps gateway for AWS

클로드 앱스 게이트웨이 포 AWS는 조직이 클로드 코드와 클로드 데스크톱의 인증, 정책, 사용량, 비용 및 요청 경로를 하나의 자체 호스팅 제어 지점에서 관리하도록 지원한다.

aws.amazon.com
#anthropic#privacy-design#service-design#ai-architecture
이전1234…222 / 22다음