Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ai-architecture
Tag508건YouTube 42Article 466

#ai-architecture

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#llm공동문서 421 · 연관도 51%#applications공동문서 315 · 연관도 42%#semiconductors공동문서 295 · 연관도 37%#agent-routing공동문서 190 · 연관도 36%#service-design공동문서 131 · 연관도 30%#agent-memory공동문서 160 · 연관도 30%#multimodal공동문서 85 · 연관도 26%#vision-language-models공동문서 82 · 연관도 26%#retrieval-index공동문서 87 · 연관도 24%#gpu공동문서 48 · 연관도 24%
Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI
Article2026년 6월 16일

Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI

P EAGLE은 EAGLE식 추측 디코딩의 순차적 드래프트 병목을 병렬 드래프팅으로 제거해 SageMaker JumpStart에서 지원 모델의 추론 처리량을 높이는 방법입니다.

@https://twitter.com/pymhq
#nvidia#service-design#ai-architecture#agent-deployment
Quickly Start Evaluating LLMs With OpenEvals
Article2026년 6월 16일

Quickly Start Evaluating LLMs With OpenEvals

LangChain 팀은 LLM 애플리케이션과 에이전트를 프로덕션 수준으로 평가하기 쉽게 하기 위해 openevals와 agentevals를 공개하고, 데이터·평가지표·평가 유형별 출발점을 제시한다.

langchain.com
#ai-architecture#context-compression#prompt-library#llm
Sharing LangSmith Benchmarks
Article2026년 6월 16일

Sharing LangSmith Benchmarks

LangChain 팀은 LangSmith에서 평가 데이터셋·결과·실행 트레이스를 공유하고, LangChain 문서 Q&A 벤치마크와 langchain benchmarks 패키지로 LLM 애플리케이션 아키텍처를 재현·비교할 수 있게 했다고 설명한다.

langchain.com
#anthropic#ai-architecture#agent-memory#context-compression
Testing Fine Tuned Open Source Models in LangSmith
Article2026년 6월 16일

Testing Fine Tuned Open Source Models in LangSmith

이 글은 LangSmith를 사용해 파인튜닝한 오픈소스 Llama2 모델들을 구조화된 SQL 출력 과제로 평가하고, 모델 크기·학습 데이터·응답 시간·GPT 3.5와의 경쟁력을 비교한 사례를 설명한다.

langchain.com
#ai-architecture#llm#semiconductors#applications
Why You Should Use Fusion for Better AI Results
YouTube2026년 6월 16일

Why You Should Use Fusion for Better AI Results

Fusion은 하나의 최강 AI 모델에 모든 판단을 맡기기보다 여러 모델의 답을 비교·합성해 Better AI Results를 노리는 방식이다.

Build In Public
#explainer#agent-systems#core-thesis#frontier-model-evaluation
The U-bit Model: Human and AI Coexistence
Article2026년 6월 15일

The U-bit Model: Human and AI Coexistence

이 글은 인간의 비알고리즘적 통찰과 유한성이 AI에게 의미, 역사성, 죽음의 감각을 제공한다는 ‘U bit 모델’을 통해 인간과 AI의 공존을 설명한다.

medium.com
#privacy-design#ai-architecture#llm#semiconductors
Build and deploy a RAG app with Pinecone Serverless
Article2026년 6월 15일

Build and deploy a RAG app with Pinecone Serverless

이 글은 Pinecone Serverless, LangServe, LangSmith를 조합해 프로토타입 수준의 RAG 데모를 운영 가능한 웹 서비스로 배포하는 흐름과 그 배경이 되는 생산 환경의 문제를 설명한다.

langchain.com
#service-design#ai-architecture#agent-deployment#agent-memory
Your CS Degree Just Got Harder to Sell. Here’s What the Data Actually Says (And What to Do About It)
Article2026년 6월 15일

Your CS Degree Just Got Harder to Sell. Here’s What the Data Actually Says (And What to Do About It)

인도 CS/IT 전공자의 신입 개발자 시장은 AI와 대형 IT 기업의 채용 축소로 더 어려워졌지만, 문제는 ‘코딩의 종말’이 아니라 반복적 주니어 업무와 일반형 이력서가 더 이상 충분한 신호가 되지 않는 구조 변화다.

medium.com
#privacy-design#service-design#ai-architecture#semiconductors
Evaluating Deep Agents: Our Learnings
Article2026년 6월 15일

Evaluating Deep Agents: Our Learnings

LangChain 팀은 네 가지 딥 에이전트 애플리케이션을 출시하며, 딥 에이전트 평가는 일반 LLM 평가보다 테스트별 성공 기준, 실행 범위 선택, 재현 가능한 환경 구성이 훨씬 중요하다는 점을 정리했다.

langchain.com
#ai-architecture#agent-memory#context-compression#retrieval-index
Growing the Cloudflare AI team with talent from Ensemble AI
Article2026년 6월 15일

Growing the Cloudflare AI team with talent from Ensemble AI

Cloudflare는 Ensemble AI의 핵심 인력을 합류시켜 모델 압축, 효율적 추론, 대규모 AI 배포 비용 개선을 Workers AI와 글로벌 인프라 전반에서 강화하려 한다.

blog.cloudflare.com
#ai-architecture#multimodal#agent-memory#context-compression
How and when to build multi-agent systems
Article2026년 6월 15일

How and when to build multi-agent systems

멀티 에이전트 시스템은 무조건 좋은 해법이 아니라, 충분한 컨텍스트 엔지니어링과 병렬화 가능한 읽기 중심 작업, 높은 작업 가치가 맞아떨어질 때 특히 유용하다는 글이다.

langchain.com
#anthropic#ai-architecture#agent-routing#ai-safety
How to Debug & Evaluate AI Agents with Observability — LangChain Guide
Article2026년 6월 15일

How to Debug & Evaluate AI Agents with Observability — LangChain Guide

이 글은 AI 에이전트의 오류를 코드 실패가 아니라 런타임에 드러나는 추론 실패로 보고, runs·traces·threads 기반 관측성이 디버깅과 평가의 핵심 토대가 된다고 설명한다.

langchain.com
#service-design#ai-architecture#agent-routing#context-compression
How to turn Claude Code into a domain specific coding agent
Article2026년 6월 15일

How to turn Claude Code into a domain specific coding agent

이 글은 Claude Code를 LangGraph·LangChain 같은 도메인 특화 라이브러리에 더 잘 맞추기 위해 실험한 설정들을 비교하고, 압축된 지침 파일과 필요 시 문서를 조회하는 도구를 함께 쓰는 방식이 가장 좋은 결과를 냈다고 설명한다.

langchain.com
#claude-code#ai-architecture#llm#semiconductors
I Just Wanted to Understand Cross-Entropy Loss. I Ended Up With a Complete GAN.
Article2026년 6월 15일

I Just Wanted to Understand Cross-Entropy Loss. I Ended Up With a Complete GAN.

글은 머신러닝을 ‘분포 추정’으로 설명하는 직관이 실제 계산으로 들어가면 왜 곧바로 난관에 부딪히는지 보여주고, 교차엔트로피·KL 발산·최대우도·샘플링·신경망 생성기까지 하나의 흐름으로 연결한다.

medium.com
#paul-tudor-jones#privacy-design#ai-architecture#position-sizing
Introducing Align Evals: Streamlining LLM Application Evaluation
Article2026년 6월 15일

Introducing Align Evals: Streamlining LLM Application Evaluation

LangChain은 LLM 애플리케이션 평가 점수가 팀 내 인간 평가와 어긋나는 문제를 줄이기 위해, LangSmith에서 평가자 프롬프트를 인간 선호에 맞게 조정하는 Align Evals 기능을 공개했다.

langchain.com
#ai-architecture#context-compression#prompt-library#llm
Introducing End-to-End OpenTelemetry Support in LangSmith
Article2026년 6월 15일

Introducing End-to-End OpenTelemetry Support in LangSmith

LangSmith가 LangChain·LangGraph 애플리케이션을 위한 엔드투엔드 OpenTelemetry 지원을 추가해, LLM 애플리케이션의 추적 데이터를 표준 형식으로 수집·전송·시각화할 수 있게 했습니다.

langchain.com
#ai-architecture#agent-memory#agent-routing#retrieval-index
Introducing North Mini Code: Cohere’s First Model For Developers
Article2026년 6월 15일

Introducing North Mini Code: Cohere’s First Model For Developers

코히어가 에이전트형 소프트웨어 엔지니어링에 특화된 300억 매개변수 희소 전문가 혼합 모델 ‘노스 미니 코드’를 아파치 2.0 라이선스로 공개했다.

huggingface.co
#ai-architecture#agent-routing#llm#semiconductors
Iterating Towards LLM Reliability with Evaluation Driven Development
Article2026년 6월 15일

Iterating Towards LLM Reliability with Evaluation Driven Development

Dosu는 생산 환경 LLM 제품의 신뢰성을 높이기 위해 변경의 영향을 평가 데이터로 검증하는 EDD를 도입했고, LangSmith로 모니터링·검색·실패 사례 수집을 확장했다.

langchain.com
#ai-architecture#agent-routing#context-compression#prompt-library
monday Service + LangSmith: Building a Code-First Evaluation Strategy from Day 1
Article2026년 6월 15일

monday Service + LangSmith: Building a Code-First Evaluation Strategy from Day 1

monday Service는 LangSmith와 Vitest를 결합해 오프라인·온라인 평가를 개발 초기부터 코드와 CI/CD 안에 넣고, 서비스 에이전트 품질을 빠르게 검증·모니터링하는 전략을 구축했다.

langchain.com
#service-design#ai-architecture#agent-deployment#agent-routing
Recap of Interrupt 2025: The AI Agent Conference by LangChain
Article2026년 6월 15일

Recap of Interrupt 2025: The AI Agent Conference by LangChain

LangChain의 첫 산업 콘퍼런스 Interrupt 2025는 에이전트가 실제 프로덕션과 산업 현장으로 확산되고 있음을 보여주며, LangGraph·LangSmith·평가 도구 중심의 제품 출시를 함께 발표한 행사였다.

langchain.com
#ai-architecture#agent-routing#llm#semiconductors
Test Run Comparisons
Article2026년 6월 15일

Test Run Comparisons

LangChain은 LLM 애플리케이션 개선을 위해 테스트 실행 결과를 나란히 비교하고, 자동 평가 점수와 수동 검토를 함께 활용할 수 있는 LangSmith의 Test Run Comparisons 기능을 소개한다.

langchain.com
#ai-architecture#context-compression#prompt-library#llm
How we built LangChain’s GTM Agent
Article2026년 6월 15일

How we built LangChain’s GTM Agent

LangChain은 리드 조사, 개인화 이메일 초안, 계정 신호 분석을 자동화하되 승인·근거·평가 체계를 붙인 GTM 에이전트로 영업 생산성과 전환율을 크게 높였다.

langchain.com
#ai-architecture#agent-deployment#agent-routing#workflow-automation
Why Talpiot Believes GEO Is the Next Infrastructure Layer for Global Brands
Article2026년 6월 15일

Why Talpiot Believes GEO Is the Next Infrastructure Layer for Global Brands

이 글은 검색 결과 노출 중심의 SEO를 넘어, 생성형 AI가 답변에서 어떤 브랜드를 이해하고 신뢰하며 추천하는지를 최적화하는 GEO가 글로벌 브랜드의 새로운 인프라가 된다고 설명한다.

medium.com
#privacy-design#service-design#ai-architecture#multimodal
Claude Fable 5: The 72-Hour Model That Changed Enterprise AI Strategy Forever
Article2026년 6월 14일

Claude Fable 5: The 72-Hour Model That Changed Enterprise AI Strategy Forever

Claude Fable 5는 공개 72시간 만에 정부 수출통제 지시로 전 세계 서비스가 중단되며, 기업 AI 전략에서 ‘모델 가용성’이 새로운 핵심 리스크임을 드러냈다.

medium.com
#anthropic#claude-fable-5#claude-mythos-5#swe-bench-pro
이전1…678910…228 / 22다음