Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Introducing GPT-Live
Article2026년 7월 8일

Introducing GPT-Live

GPT‑Live는 동시에 듣고 말하는 전이중 구조와 최신 추론 모델로의 작업 위임을 결합해, 더 자연스럽고 지능적인 실시간 음성 대화를 구현한 새로운 ChatGPT Voice 모델이다.

openai.com
#openai#privacy-design#ai-architecture#agent-memory
Manage AI applications on Mac with Jamf’s AI Governance and Amazon Bedrock
Article2026년 7월 8일

Manage AI applications on Mac with Jamf’s AI Governance and Amazon Bedrock

Jamf의 AI Governance는 관리형 Mac에 Claude Code·Claude Desktop·OpenAI Codex의 Amazon Bedrock 연결 설정과 사용 정책을 중앙 배포하고, 적용 상태와 AI 활동을 검증할 수 있게 한다.

aws.amazon.com
#ai-architecture#agent-deployment#agent-routing#change-management
Native-speed vLLM transformers modeling backend
Article2026년 7월 8일

Native-speed vLLM transformers modeling backend

transformers의 vLLM 모델링 백엔드는 여러 호환 LLM 아키텍처에서 별도 vLLM 포팅 없이 네이티브 vLLM 구현과 같거나 더 빠른 추론 성능을 내도록 개선되었다.

huggingface.co
#linear-attention#ai-architecture#agent-routing#capex-cycle
Securing Amazon Bedrock AgentCore Runtime with AWS WAF
Article2026년 7월 8일

Securing Amazon Bedrock AgentCore Runtime with AWS WAF

AgentCore Runtime 앞단에 AWS WAF를 적용할 때 ALB와 VPC Interface Endpoint를 중심으로 구성하는 두 가지 패턴, 즉 Lambda 프록시 방식과 VPC Endpoint ENI 직접 타깃 방식을 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-deployment#llm
How Schneider Electric Built Their LLMOps Foundations With LangSmith
Article2026년 7월 7일

How Schneider Electric Built Their LLMOps Foundations With LangSmith

Schneider Electric은 LangSmith를 중심으로 관측성·평가·배포의 세 축을 갖춘 LLMOps 기반을 구축해, 엄격한 보안과 데이터 통제 아래 60개 이상의 AI 제품과 에이전트를 엔터프라이즈 규모로 운영하고 있다.

langchain.com
#privacy-design#ai-architecture#agent-deployment#agent-routing
AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters
Article2026년 7월 7일

AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters

엔비디아는 에이전트형 AI 시대에는 GPU만큼이나 에이전트 루프를 빠르게 진전시키는 대규모 단일 스레드 성능 중심 CPU가 중요하며, Vera가 그 요구에 맞춘 CPU라고 설명한다.

Ian Buck
#nvidia#ai-architecture#agent-memory#agent-routing
Build a serverless image editing agent with Amazon Bedrock AgentCore harness
Article2026년 7월 7일

Build a serverless image editing agent with Amazon Bedrock AgentCore harness

이 글은 자연어 지시로 이미지를 편집하는 서버리스 에이전트를 Amazon Bedrock AgentCore harness, AgentCore Memory, AgentCore Gateway, Lambda 도구, React 프런트엔드로 구성하고 배포하는 방식을 설명한다.

aws.amazon.com
#anthropic#service-design#ai-architecture#agent-memory
Build a unified semantic layer across datasets with multi-dataset Topics in Amazon Quick
Article2026년 7월 7일

Build a unified semantic layer across datasets with multi-dataset Topics in Amazon Quick

다중 데이터 세트 주제는 최대 12개 데이터 세트의 관계와 의미 정보를 하나의 관리형 계층으로 통합해, 사용자가 기본 스키마를 몰라도 자연어로 여러 데이터 세트에 걸친 분석 결과를 얻도록 지원합니다.

aws.amazon.com
#service-design#ai-architecture#llm#semiconductors
Change Propagation: SDD’s Central Unsolved Challenge
Article2026년 7월 7일

Change Propagation: SDD’s Central Unsolved Challenge

이 글은 SDD에서 오래된 문서가 AI 에이전트의 잘못된 코드 생성으로 직결되며, 변경 사항을 관련 스펙 전체로 전파하는 문제가 아직 해결되지 않았다고 주장한다.

Godel Technologies
#privacy-design#ai-architecture#agent-routing#semiconductors
Data modeling best practices for Amazon Quick Sight multi-dataset relationships
Article2026년 7월 7일

Data modeling best practices for Amazon Quick Sight multi-dataset relationships

Amazon Quick Sight의 다중 데이터셋 관계는 테이블을 미리 하나로 합치지 않고 토픽에서 논리적 관계를 정의해 필요한 시점에만 내부 조인을 수행함으로써, 데이터의 고유 세분성을 보존하고 분석 모델의 재사용성과 관리 효율을 높이는 기능이다.

aws.amazon.com
#ai-architecture#quick-sight-sql#llm#semiconductors
Enrich your datasets with business context: Migrating from legacy Topics to semantic datasets in Amazon Quick
Article2026년 7월 7일

Enrich your datasets with business context: Migrating from legacy Topics to semantic datasets in Amazon Quick

데이터세트 보강은 기존 토픽에 분리되어 있던 업무 의미 정보를 데이터세트 자체에 통합하고, 새 토픽이 여러 데이터세트를 연결하는 상위 의미·추론 계층으로 작동하게 하는 기반입니다.

aws.amazon.com
#ai-architecture#agent-routing#llm#semiconductors
Monitoring discriminative ML models using Amazon SageMaker AI with MLflow
Article2026년 7월 7일

Monitoring discriminative ML models using Amazon SageMaker AI with MLflow

이 글은 분류·회귀용 판별형 머신러닝 모델의 성능 저하를 데이터 드리프트와 모델 품질 변화로 나누어 설명하고, SageMaker AI, MLflow, Evidently를 이용해 배치 및 실시간 추론 환경에서 이를 모니터링하는 구조를 제시한다.

aws.amazon.com
#service-design#ai-architecture#agent-deployment#agent-routing
The foundational elements of AI architecture that IT leaders need to scale
Article2026년 7월 7일

The foundational elements of AI architecture that IT leaders need to scale

AI가 에이전트형 시스템으로 확장될수록, IT 리더가 장기적으로 의존할 수 있는 핵심 기반은 데이터 준비, 컨텍스트 엔지니어링, 거버넌스와 LLM 관측성, 그리고 인간 전문성이다.

technologyreview.com
#anthropic#ai-architecture#agent-routing#context-compression
Data on AI Models
Article2026년 7월 6일

Data on AI Models

Epoch AI의 “Data on AI Models”는 1950년부터 현재까지 3500개가 넘는 머신러닝 모델의 핵심 지표와 추정치를 추적해 공개하는 AI 모델 데이터베이스입니다.

epoch.ai
#ai-architecture#agent-deployment#llm#semiconductors
How Open Models Are Driving AI Research
Article2026년 7월 6일

How Open Models Are Driving AI Research

ICML 2026 논문 흐름은 공개 프런티어 모델과 공개 AI 인프라가 현대 AI 연구의 핵심 기반으로 자리 잡았음을 보여준다.

JJ Kim
#nvidia#ai-architecture#agent-routing#capex-cycle
PRX Part 4: Our Data Strategy
Article2026년 7월 6일

PRX Part 4: Our Data Strategy

PRX의 데이터 전략은 공개·내부 데이터셋을 폭넓게 결합하고 이미지마다 일관된 장문 설명을 다시 생성한 뒤, 탐색·가공에는 랜스를, 분산 학습 스트리밍에는 모자이크 데이터 샤드를 사용하는 것이다.

huggingface.co
#ai-architecture#ai-distribution#capex-cycle#search-advertising
Run MiniMax models on Amazon Bedrock
Article2026년 7월 6일

Run MiniMax models on Amazon Bedrock

이 글은 Amazon Bedrock에서 MiniMax M2 계열 모델을 사용하는 방법과 모델 선택 기준, 접근 엔드포인트, 초기 설정 및 도구 호출 예제를 설명한다.

aws.amazon.com
#service-design#ai-architecture#multimodal#agent-deployment
The only AI glossary you'll need this year
Article2026년 7월 3일

The only AI glossary you'll need this year

이 글은 인공지능 분야에서 자주 쓰이는 핵심 용어를 비전문가도 이해할 수 있도록 AGI, AI 에이전트, 추론, LLM, 환각, 미세조정 등 주요 개념별로 풀어 설명한 실용적 용어집이다.

Natasha Lomas, Romain Dillet, Kyle Wiggers, Lucas Ropek
#anthropic#privacy-design#service-design#ai-architecture
How to Use RLMs in Deep Agents
Article2026년 7월 1일

How to Use RLMs in Deep Agents

Deep Agents는 RLM에서 영감을 받은 동적 서브에이전트와 코드 인터프리터를 통해 긴 컨텍스트 작업을 턴별 추론이 아니라 프로그래밍 가능한 재귀적 워크플로로 처리하려 한다.

langchain.com
#ai-architecture#agent-routing#workflow-automation#llm
Hugging Face and Cerebras bring Gemma 4 to real-time voice AI
Article2026년 7월 1일

Hugging Face and Cerebras bring Gemma 4 to real-time voice AI

Hugging Face와 Cerebras는 개방형·모듈형 음성 AI 파이프라인에 고속 추론을 결합해 Gemma 4 기반 실시간 음성 대화를 더 자연스럽게 만들 수 있음을 보여준다.

huggingface.co
#nvidia#ai-architecture#multimodal#agent-routing
The latest AI news we announced in June 2026
Article2026년 7월 1일

The latest AI news we announced in June 2026

구글은 2026년 6월 AI 발표에서 로컬 모델, 멀티모달 개발 도구, Android 17·Pixel 기능, 실시간 번역, 교육·연구·공공서비스·기후 대응 사례까지 일상과 업무 전반에 AI를 자연스럽게 통합하려는 방향을 제시했다.

blog.google
#ai-architecture#multimodal#agent-routing#change-management
Run NVIDIA Nemotron and OpenAI GPT OSS models on Amazon Bedrock in AWS GovCloud (US)
Article2026년 7월 1일

Run NVIDIA Nemotron and OpenAI GPT OSS models on Amazon Bedrock in AWS GovCloud (US)

AWS GovCloud(US)의 보안·규정 준수 경계 안에서 OpenAI GPT OSS와 NVIDIA Nemotron 오픈웨이트 모델을 Amazon Bedrock으로 호출할 수 있게 됐다는 안내입니다.

aws.amazon.com
#nvidia#openai#service-design#ai-architecture
Your site, your rules: new AI traffic options for all customers
Article2026년 7월 1일

Your site, your rules: new AI traffic options for all customers

Cloudflare는 웹사이트 소유자가 AI 트래픽을 일괄 차단하는 대신 Search, Agent, Training 용도별로 관리하고, 봇의 콘텐츠 사용 방식까지 더 세밀하게 표현·통제할 수 있는 새 옵션을 공개했다.

blog.cloudflare.com
#privacy-design#service-design#ai-architecture#search-advertising
How Deep Agents Run Untrusted Code Without a Sandbox
Article2026년 6월 30일

How Deep Agents Run Untrusted Code Without a Sandbox

Deep Agents의 코드 인터프리터는 에이전트가 작성한 오케스트레이션 코드를 별도 컴퓨터형 샌드박스 없이도 WASM, QuickJS, 제한된 capability bridge, durable pause로 안전하게 실행하려는 설계다.

langchain.com
#ai-architecture#agent-memory#agent-routing#context-compression
이전12345…223 / 22다음