Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Anthropic’s IPO Risk Is No Longer Model Performance. It Is Commercialization Control.
Article2026년 6월 14일

Anthropic’s IPO Risk Is No Longer Model Performance. It Is Commercialization Control.

Anthropic의 IPO 위험은 Claude의 성능 부족이 아니라, 최상위 모델을 예측 가능한 방식으로 상업화하고 접근 권한을 통제할 수 있느냐로 이동했다.

medium.com
#anthropic#privacy-design#service-design#ai-architecture
Your Data Warehouse Isn’t Dying. It’s Getting Promoted.
Article2026년 6월 14일

Your Data Warehouse Isn’t Dying. It’s Getting Promoted.

AI 시대에 데이터 웨어하우스는 사라지는 것이 아니라, AI의 판단을 검증하는 신뢰 기준층으로 승격된다.

medium.com
#privacy-design#ai-architecture#llm#semiconductors
Green Build, Lost Team: The Cognitive Debt of Vibe Coding
Article2026년 6월 14일

Green Build, Lost Team: The Cognitive Debt of Vibe Coding

이 글은 AI 보조 코딩이 빌드는 통과시키지만 팀의 이해와 소유권을 따라잡지 못할 때 발생하는 ‘인지 부채’를 기술 부채와 구분해 설명한다.

sal-pc.medium.com
#privacy-design#ai-architecture#agent-routing#llm
The Hill-Climbing Machine. What Satya Nadella Got Right — and the…
Article2026년 6월 14일

The Hill-Climbing Machine. What Satya Nadella Got Right — and the…

이 글은 사티아 나델라가 말한 AI 시대의 ‘학습 루프’가 옳지만, 대부분의 중소기업에는 그 루프를 작동시킬 데이터 정리, 프로세스 문서화, 거버넌스 기반이 먼저 필요하다고 주장한다.

medium.com
#anthropic#privacy-design#service-design#ai-architecture
I Spent a Week Inside RNNs — Here’s Everything That Finally Clicked
Article2026년 6월 14일

I Spent a Week Inside RNNs — Here’s Everything That Finally Clicked

원문은 순서와 기억이 필요한 시퀀스 데이터를 설명하기 위해 RNN이 왜 등장했는지, 텍스트가 숫자로 변환되는 과정, 순전파와 시간 역전파, 기울기 문제, 그리고 이를 완화하기 위한 LSTM의 기억 구조를 초보자 관점에서 단계적으로 풀어낸다.

medium.com
#service-design#ai-architecture#agent-memory#retrieval-index
The Integration of TOPO-2026 into the Mixtral-8x7B FP8 Architecture: A Pipeline for Verifiable…
Article2026년 6월 14일

The Integration of TOPO-2026 into the Mixtral-8x7B FP8 Architecture: A Pipeline for Verifiable…

이 글은 TOPO 2026을 Mixtral 8x7B FP8 구조에 결합해 지속 학습 중 발생하는 catastrophic forgetting을 상수 메모리 규모의 검증 가능한 파이프라인으로 완화할 수 있음을 설명한다.

Frank Morales Aguilera
#privacy-design#ai-architecture#agent-routing#workflow-automation
vLLM Internalised: The Mechanics of Modern LLM Inference
Article2026년 6월 14일

vLLM Internalised: The Mechanics of Modern LLM Inference

vLLM은 KV 캐시를 작은 페이지로 관리하고 스케줄러가 토큰 예산을 배분함으로써, 단일 사용자 중심의 llama.cpp와 달리 GPU 위에서 다수의 동시 요청을 처리하도록 설계된 LLM 추론 엔진이다.

medium.com
#ai-architecture#agent-memory#capex-cycle#retrieval-index
What a Neural Network Actually Is
Article2026년 6월 14일

What a Neural Network Actually Is

대규모 언어모델은 인간 텍스트의 통계적 구조를 학습해 다음 토큰 확률을 계산하는 거대한 함수이며, 그 유용성과 한계는 이 목표와 불투명성에서 나온다.

medium.com
#privacy-design#ai-architecture#llm#semiconductors
Why the AI Operating Model Is Not Enough — Organizational Sovereignty in the AI Era
Article2026년 6월 14일

Why the AI Operating Model Is Not Enough — Organizational Sovereignty in the AI Era

AI 시대에는 고정된 AI 운영모델만으로는 부족하며, 조직은 운영모델 자체를 계속 점검하고 갱신하는 메타 운영모델과 조직 주권을 갖춰야 한다.

medium.com
#ai-architecture#agent-routing#llm#semiconductors
Hermes 에이전트로 나만의 AI 직원 팀 만들기!
YouTube2026년 6월 13일

Hermes 에이전트로 나만의 AI 직원 팀 만들기!

Hermes 에이전트로 나만의 AI 직원 팀을 만들려면 한 명의 만능 비서보다 프로필·기억·채널·자동화를 직무별로 나눠 운영하는 구조가 핵심입니다.

시민개발자 구씨
#anthropic#ai-safety#hermes-ai#explainer
How Box AI built enterprise content agents with Deep Agents
Article2026년 6월 12일

How Box AI built enterprise content agents with Deep Agents

Box는 Deep Agents 기반의 부모·자식 에이전트 구조와 미들웨어를 활용해 단일 문서 Q&A를 넘어 기업 전체 콘텐츠 검색, 다중 문서 종합, 보고서 생성까지 수행하는 Box Agent를 구축했다.

langchain.com
#langchain#box-agent#box-ai#deep-agents
How to Choose the Right Sandbox for AI Agents
Article2026년 6월 12일

How to Choose the Right Sandbox for AI Agents

AI 에이전트가 코드를 작성·실행할 때 생기는 프롬프트 인젝션과 데이터 유출 위험을 줄이려면, 격리 파일시스템·네트워크 제한·자원 제한·재사용 통제·커널 수준 격리를 갖춘 샌드박스를 선택해야 한다.

미상
#langchain#langgraph#deep-agents#langsmith-sandboxes
Built from the inside out: How AWS Professional Services became a frontier team first
Article2026년 6월 12일

Built from the inside out: How AWS Professional Services became a frontier team first

AWS Professional Services는 기존 컨설팅 프로세스에 AI 도구를 덧붙이는 대신 전달 방식을 내부부터 재설계해, 수개월 걸리던 업무를 며칠 단위로 압축하는 AI native 전달 모델을 구축했다고 설명한다.

aws.amazon.com
#ai-architecture#agent-deployment#agent-routing#workflow-automation
Introducing Mellum2: A 12B Mixture-of-Experts Model by JetBrains
Article2026년 6월 12일

Introducing Mellum2: A 12B Mixture-of-Experts Model by JetBrains

JetBrains는 텍스트·코드 워크로드의 저지연 추론을 겨냥해, 총 12B 파라미터 중 토큰당 2.5B만 활성화하는 Apache 2.0 라이선스의 MoE 모델 Mellum2를 공개했다.

huggingface.co
#ai-architecture#multimodal#agent-memory#agent-routing
Migrating Your GitHub CI to Hugging Face Jobs
Article2026년 6월 12일

Migrating Your GitHub CI to Hugging Face Jobs

GitHub Actions의 제어 흐름은 유지하면서 실제 CI 작업을 허깅페이스 잡스의 임시 CPU·GPU 러너에서 실행하면, 맞춤형 하드웨어와 컨테이너 이미지를 활용해 속도와 GPU 테스트 범위를 개선할 수 있다.

huggingface.co
#ai-architecture#agent-routing#ai-infrastructure#capex-cycle
Mythos Begets Fable, Cursor's Composer 2.5, Agents Building Agents
Article2026년 6월 12일

Mythos Begets Fable, Cursor's Composer 2.5, Agents Building Agents

원문은 데스크톱 AI 에이전트와 오픈소스 대안 OpenCoworker를 소개한 뒤, Anthropic의 Claude Mythos 5·Claude Fable 5 출시, 성능, 안전장치, 데이터 보관 정책, 논란을 상세히 다룬다.

deeplearning.ai
#kimi-k2-5#anthropic#cursor#privacy-design
olmo-eval: An evaluation workbench for the model development loop
Article2026년 6월 12일

olmo-eval: An evaluation workbench for the model development loop

olmo eval은 완성된 모델의 일회성 점수 산출을 넘어, LLM 개발 중 반복되는 체크포인트 평가·벤치마크 구성·도구 사용 평가·결과 비교를 하나의 재현 가능한 워크벤치로 묶는 공개 평가 도구입니다.

huggingface.co
#ai-architecture#agent-routing#context-compression#prompt-library
From PDFs to insights: Architecting an intelligent document processing pipeline with AWS generative AI services
Article2026년 6월 12일

From PDFs to insights: Architecting an intelligent document processing pipeline with AWS generative AI services

이 글은 기존 OCR의 한계를 넘어 문서의 텍스트·표·시각 요소·문맥을 함께 추출하고, 검색·RAG·에이전트 조정을 결합해 지능형 문서 처리 파이프라인을 구성하는 방식을 설명한다.

aws.amazon.com
#service-design#ai-architecture#multimodal#agent-routing
Scaling Security Insights: how we achieved a 10x increase in global scanning capacity
Article2026년 6월 12일

Scaling Security Insights: how we achieved a 10x increase in global scanning capacity

Cloudflare는 Security Insights의 스캔 병목을 Kafka 처리 방식, 데이터베이스 쓰기, API 배치, 스케줄러 설계 전반에서 개선해 초당 약 10회였던 스캔 처리량을 피크 기준 120회 이상으로 끌어올렸다.

blog.cloudflare.com
#resort-experience#ai-architecture#agent-routing#workflow-automation
Building Supercharger: How Rocket Close optimized title operations with agentic AI
Article2026년 6월 12일

Building Supercharger: How Rocket Close optimized title operations with agentic AI

Rocket Close는 주별 권원 심사와 주문 처리의 병목을 줄이기 위해 Supercharger라는 에이전트형 AI 솔루션을 구축해 내부 지식, 주문 데이터, 정책 검색, 자연어 질의응답을 통합하고 운영 효율과 고객 경험을 개선했다.

aws.amazon.com
#supercharger#rocket-close#rocket-companies#amazon-web-services
Late Stage Venture Is About Late Stage Founders
Article2026년 6월 11일

Late Stage Venture Is About Late Stage Founders

이 글은 성장단계 벤처의 본질이 밸류에이션이나 비상장 기간이 아니라, 기술 기회를 계속 읽고 자본을 효과적으로 배치할 수 있는 후기 단계 창업자에게 있다고 주장한다.

a16z.com
#service-design#ai-architecture#change-management#organizational-redesign
OpenAI raises $122 billion to accelerate the next phase of AI
Article2026년 6월 11일

OpenAI raises $122 billion to accelerate the next phase of AI

OpenAI는 1,220억 달러 규모의 신규 자금 조달을 통해 AI의 핵심 인프라 기업으로서 소비자·기업·개발자·컴퓨트가 맞물리는 성장 플라이휠을 더 큰 규모로 확장하겠다고 밝혔다.

openai.com
#openai#ai-architecture#multimodal#agent-routing
Our agreement with the Department of War
Article2026년 6월 11일

Our agreement with the Department of War

OpenAI는 전쟁부와의 기밀 환경 AI 배포 계약에 대해 국내 감시, 자율무기 지휘, 고위험 자동결정 금지를 핵심 조건으로 두고, 클라우드 전용 배포와 안전장치 유지, 계약 조항, 인력 관여를 통해 이를 집행하겠다고 설명했다.

openai.com
#anthropic#privacy-design#ai-architecture#agent-deployment
Profiling in PyTorch (Part 2): From nn.Linear to a Fused MLP
Article2026년 6월 11일

Profiling in PyTorch (Part 2): From nn.Linear to a Fused MLP

이 글은 프로파일러 추적을 통해 nn.Linear의 전치·행렬곱·편향 처리가 실제로 어떻게 실행되는지 분석하고, 단일 선형 계층에서 GeGLU MLP의 다중 커널 구조로 관찰 범위를 확장한다.

huggingface.co
#ai-architecture#agent-memory#capex-cycle#context-compression
이전1…7891011…229 / 22다음