Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Save Big and Play Bigger: GeForce NOW Summer Sale Brings Major Membership Savings
Article2026년 6월 11일

Save Big and Play Bigger: GeForce NOW Summer Sale Brings Major Membership Savings

엔비디아는 GeForce NOW 여름 세일로 12개월 멤버십 할인과 클라우드 게이밍 혜택, 신규 게임 및 Guild Wars 보상을 함께 소개했다.

GeForce NOW Community
#nvidia#ai-architecture#ai-infrastructure#capex-cycle
MORE Hermes Agent + HyperFrames: Free AI Tools to Make Amazing Videos
YouTube2026년 6월 11일

MORE Hermes Agent + HyperFrames: Free AI Tools to Make Amazing Videos

Hermes Agent + HyperFrames는 무료 AI 영상 제작 도구로 꽤 실용적인 결과를 만들 수 있지만, 핵심은 “비슷한 효과”가 아니라 실제 HyperFrames catalog transition과 block을 정확히 호출하게 만드는 데 있다.

Tonbi''s AI Garage
#agent-memory#context-compression#retrieval-index#agent-systems
The Missing Link Between Agents and Applications
Article2026년 6월 10일

The Missing Link Between Agents and Applications

서버 중심 도구만으로는 브라우저·앱·기기 안에 있는 상태와 기능을 다루기 어렵기 때문에, LangChain의 headless tools는 클라이언트 기능을 에이전트 추론 루프 안의 정식 도구로 연결해 이 간극을 줄이려 한다.

LangChain
#langchain#browser-runtime#headless-tools#desktop-app-runtime
Build an AI-Powered Equipment Repair Assistant Using Amazon Bedrock AgentCore
Article2026년 6월 10일

Build an AI-Powered Equipment Repair Assistant Using Amazon Bedrock AgentCore

AWS는 Amazon Bedrock AgentCore, Strands Agents SDK, Amazon Nova 2 Lite, Bedrock Knowledge Base, AgentCore Memory를 결합해 농기계 수리 현장에서 자연어로 고장 진단과 부품·절차 추천을 제공하는 AI 장비 수리 assistant 아키텍처를 제시했다.

Puneeth Komaragiri, Chaitanya Addanki
#agentcore-memory#agentcore-runtime#amazon-bedrock-agentcore#strands-agents-sdk
Encoding Your Domain Expert: The Context Layer Behind Spotify's Data Assistant
Article2026년 6월 10일

Encoding Your Domain Expert: The Context Layer Behind Spotify's Data Assistant

스포티파이는 방대한 데이터 웨어하우스를 LLM에 그대로 넣는 대신, 도메인 전문가가 큐레이션한 ‘컨텍스트 레이어’를 통해 신뢰 가능한 데이터 어시스턴트를 구축했다.

Spotify Engineering
#spotify#vedder#data-clusters#react-loop
Stop hand-tuning kernels: How Neuron Agentic Development accelerates AWS Trainium optimizations
Article2026년 6월 10일

Stop hand-tuning kernels: How Neuron Agentic Development accelerates AWS Trainium optimizations

Neuron Agentic Development는 NKI 커널 작성, 디버깅, 프로파일링, 분석을 에이전트와 스킬로 묶어 Trainium·Inferentia 기반 커널 최적화의 진입 장벽과 반복 비용을 낮추려는 도구 모음이다.

aws.amazon.com
#aws-inferentia#aws-trainium#neuron-agentic-development#neuron-kernel-interface
Route public traffic to private applications with Cloudflare
Article2026년 6월 10일

Route public traffic to private applications with Cloudflare

클라우드플레어는 공개 인터넷 트래픽을 사설 애플리케이션으로 안전하게 라우팅하면서, 원본을 공개 IP로 노출하지 않고도 WAF·봇 관리·속도 제한·캐싱·Workers 같은 애플리케이션 서비스를 적용하는 기능을 엔터프라이즈 고객 대상 비공개 베타로 공개했다.

blog.cloudflare.com
#service-design#ai-architecture#llm#semiconductors
I Built an AI Study Companion With 6 Hermes Agents + Mission Control Dashboard
YouTube2026년 6월 10일

I Built an AI Study Companion With 6 Hermes Agents + Mission Control Dashboard

AI Study Companion은 6 Hermes Agents와 Mission Control Dashboard를 묶어 PDF 업로드부터 노트·퀴즈·일정·연구·채팅까지 이어지는 학습 자동화 운영체제를 구현한 사례다.

Komputer Mechanic
#explainer#agent-systems#core-thesis#anthropic-model-roadmap
Defend against frontier cyber models: Cloudflare's architecture as customer zero
Article2026년 6월 9일

Defend against frontier cyber models: Cloudflare's architecture as customer zero

Cloudflare는 프런티어 사이버 모델이 공격 속도와 규모를 키우는 상황에서, 취약점 자체보다 그 주변의 계층형 아키텍처와 가시성·점수화·격리가 더 중요하다고 설명한다.

blog.cloudflare.com
#cloudflare#cloudforce-one#project-glasswing#waf-attack-score
NVIDIA Confidential Computing to Help Expand Apple’s Private Cloud Compute
Article2026년 6월 9일

NVIDIA Confidential Computing to Help Expand Apple’s Private Cloud Compute

엔비디아 Confidential Computing GPU가 Apple Private Cloud Compute의 Google Cloud 확장에 쓰이며, Apple Intelligence의 일부 차세대 기능을 위한 서버 측 추론과 개인정보 보호를 지원한다.

Avinash Ahuja
#nvidia#apple-silicon#privacy-design#ai-architecture
The Open Source Community is backing OpenEnv for Agentic RL
Article2026년 6월 9일

The Open Source Community is backing OpenEnv for Agentic RL

오픈엔브는 에이전트 실행 환경의 배포와 이용 방식을 표준화하는 상호운용 계층으로 역할을 명확히 하고, 공동 거버넌스를 통해 오픈소스 에이전트 강화학습의 공통 기반을 구축하려는 프로젝트다.

huggingface.co
#nvidia#ai-architecture#agent-deployment#capex-cycle
How to Build Claude Subagents Better Than 99% of People
YouTube2026년 6월 9일

How to Build Claude Subagents Better Than 99% of People

Claude Subagents를 잘 만드는 핵심은 독립 컨텍스트, 정확한 호출 조건, 제한된 권한, 반복 튜닝을 조합해 메인 세션을 오케스트레이터로 남기는 것이다.

Nate Herk
#explainer#agent-systems#core-thesis#anthropic-model-roadmap
Unlocking AI flexibility in Europe: A guide to cross-region inference for EU data processing and model access
Article2026년 6월 8일

Unlocking AI flexibility in Europe: A guide to cross-region inference for EU data processing and model access

이 글은 유럽 고객이 Amazon Bedrock의 cross Region Inference를 활용해 모델 가용성과 처리 용량을 넓히면서도 EU 지역성, 보안, 로깅, GDPR 관련 요구를 어떻게 고려할 수 있는지 설명한다.

aws.amazon.com
#amazon-bedrock#eu-cris#inference-profile#cross-region-inference
It’s safe to close your laptop now: Hosting coding agents on Amazon Bedrock AgentCore
Article2026년 6월 8일

It’s safe to close your laptop now: Hosting coding agents on Amazon Bedrock AgentCore

이 글은 노트북에서 실행되던 코딩 에이전트를 격리된 원격 실행 환경으로 옮겨, 보안·지속성·병렬성·관측 가능성을 확보하는 방법을 설명한다.

Amazon Web Services
#cloudtrail#cloudwatch#firecracker-microvm#amazon-bedrock-agentcore
DeepSeek-V4: a million-token context that agents can actually use
Article2026년 6월 8일

DeepSeek-V4: a million-token context that agents can actually use

DeepSeek V4는 최고 벤치마크 점수보다 100만 토큰 문맥을 실제 에이전트 작업에서 감당하게 만드는 긴 문맥 효율, 도구 호출 지속성, 샌드박스 기반 학습 인프라에 초점을 둔 모델이다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#context-compression
End-to-end encrypted ML inference with Amazon SageMaker AI and FHE
Article2026년 6월 8일

End-to-end encrypted ML inference with Amazon SageMaker AI and FHE

이 글은 Amazon SageMaker AI와 fully homomorphic encryption(FHE), concrete ml을 결합해 클라우드에서도 입력, 중간값, 응답을 복호화하지 않고 머신러닝 추론을 수행하는 구성과 구현 절차를 설명한다.

aws.amazon.com
#concrete-ml#concrete-python#amazon-sagemaker-ai#fully-homomorphic-encryption
Evaluate your Amazon Nova Sonic voice agent at scale, no microphone required
Article2026년 6월 8일

Evaluate your Amazon Nova Sonic voice agent at scale, no microphone required

이 글은 마이크 없이 Nova Sonic 음성 에이전트를 자동 대화·평가·배치 실행으로 검증하는 오픈소스 테스트 하네스의 필요성과 작동 방식을 설명한다.

aws.amazon.com
#service-design#ai-architecture#agent-deployment#agent-routing
Today's AI Talks Like “Nobody.” New Research Gives It Real Personality.
Article2026년 6월 8일

Today's AI Talks Like “Nobody.” New Research Gives It Real Personality.

PsychAdapter는 심리 점수를 언어모델에 직접 입력해 나이, 성격, 정신건강 특성이 반영된 개인별 언어를 생성하도록 만든 연구입니다.

hai.stanford.edu
#privacy-design#ai-architecture#prompt-library#search-advertising
Turning Cloudflare’s threat indicators into real-time WAF rules
Article2026년 6월 8일

Turning Cloudflare’s threat indicators into real-time WAF rules

Cloudflare는 Threat Events의 실시간 위협 인텔리전스를 WAF 규칙에 직접 연결해, 알려진 악성 행위자가 인프라에 도달하기 전 자동으로 탐지·차단할 수 있게 했다.

@alexandramoraru
#ai-architecture#agent-deployment#agent-routing#llm
Qwen3.7-Max Challenges Google for Third Place, AI Saves Whales, Fine-Tuning Breaks Copyright Alignment
Article2026년 6월 5일

Qwen3.7-Max Challenges Google for Third Place, AI Saves Whales, Fine-Tuning Breaks Copyright Alignment

이번 글은 AI 규제의 균형 필요성을 논한 뒤, 알리바바 Qwen3.7 Max의 성능·폐쇄화 흐름과 WhaleSpotter가 열화상 AI로 선박 고래 충돌을 줄이는 사례를 정리한다.

@DeepLearningAI
#anthropic#service-design#ai-architecture#multimodal
Dreaming: Better memory for a more helpful ChatGPT
Article2026년 6월 4일

Dreaming: Better memory for a more helpful ChatGPT

OpenAI는 ChatGPT 메모리가 더 오래, 더 정확하게, 더 관련성 있게 작동하도록 ‘dreaming’ 기반의 새 메모리 합성 아키텍처를 Plus·Pro 미국 사용자부터 배포하기 시작했다.

OpenAI
#chatgpt#dreaming#openai#saved-memories
How to Build a Custom Agent Harness
Article2026년 6월 3일

How to Build a Custom Agent Harness

유용한 에이전트를 만들려면 모델 자체보다도 작업에 맞는 맥락, 도구, 상태, 정책을 적시에 제공하는 맞춤형 하네스가 중요하며, LangChain의 create agent는 이를 미들웨어로 세밀하게 구성하는 최소 기반을 제공한다.

LangChain
#langchain#middleware#agent-harness#create-agent
Direct Preference Optimization Beyond Chatbots
Article2026년 6월 3일

Direct Preference Optimization Beyond Chatbots

DharmaOCR는 SFT 모델이 스스로 생성한 반복 퇴화 출력을 DPO의 거부 사례로 활용해, 구조화 OCR에서 모든 실험 모델군의 텍스트 퇴화율을 낮췄다.

huggingface.co
#ai-architecture#multimodal#llm#semiconductors
How to Use Transformers.js in a Chrome Extension
Article2026년 6월 3일

How to Use Transformers.js in a Chrome Extension

Manifest V3 크롬 확장 프로그램에서 모델 실행과 상태 관리는 백그라운드 서비스 워커에 집중하고, 사이드 패널과 콘텐츠 스크립트는 각각 사용자 인터페이스와 웹페이지 조작에 전념하도록 구성하는 Transformers.js 구현 안내서다.

huggingface.co
#privacy-design#service-design#ai-architecture#multimodal
이전1…89101112…2210 / 22다음