Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#llm
Tag1292건YouTube 48Article 1244

#llm

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

Alias / 동의어

large-language-models

연관 태그

#semiconductors공동문서 1040 · 연관도 83%#applications공동문서 974 · 연관도 81%#agent-routing공동문서 512 · 연관도 61%#agent-memory공동문서 468 · 연관도 55%#ai-architecture공동문서 403 · 연관도 51%#privacy-design공동문서 384 · 연관도 50%#context-compression공동문서 342 · 연관도 47%#agent-deployment공동문서 312 · 연관도 47%#service-design공동문서 286 · 연관도 42%#retrieval-index공동문서 213 · 연관도 37%
Agent Engineering: A New Discipline
Article2026년 6월 16일

Agent Engineering: A New Discipline

에이전트 엔지니어링은 예측 불가능한 LLM 에이전트를 실제 운영 환경에서 신뢰할 수 있게 만들기 위해 구축, 테스트, 배포, 관찰, 개선을 반복하는 새로운 실무 discipline이다.

langchain.com
#ai-architecture#agent-routing#context-compression#prompt-library
5 Things To Consider When Working Ai
Article2026년 6월 16일

5 Things To Consider When Working Ai

MIT Sloan은 AI가 직장에 실제로 자리 잡은 지금, 조직이 AI를 더 잘 활용하려면 설계 적합성, 조언의 객관성, 업무 흐름 재편, 비판적 점검, 노동 영향까지 함께 고려해야 한다고 정리한다.

mitsloan.mit.edu
#privacy-design#agent-routing#context-compression#prompt-library
Context Management for Deep Agents
Article2026년 6월 16일

Context Management for Deep Agents

Deep Agents SDK는 장기 작업에서 모델의 제한된 컨텍스트 창을 넘지 않도록 파일시스템 오프로딩과 요약을 결합해 필요한 정보를 보존하면서 작업 기억을 압축한다.

langchain.com
#ai-architecture#llm#semiconductors#applications
How Factory used LangSmith to automate their feedback loop and improve iteration speed by 2x
Article2026년 6월 16일

How Factory used LangSmith to automate their feedback loop and improve iteration speed by 2x

Factory는 Self hosted LangSmith로 보안 요구를 지키면서 LLM 워크플로 관측성과 피드백 루프를 자동화해 프롬프트 개선과 제품 반복 속도를 2배 높였다.

langchain.com
#privacy-design#agent-deployment#agent-routing#workflow-automation
Frontier post-training recipe review with Finbarr Timbers
Article2026년 6월 16일

Frontier post-training recipe review with Finbarr Timbers

네이선 램버트와 핀바 팀버스가 후훈련 레시피의 흐름을 인스트럭트지피티식 단일 파이프라인에서 2026년형 다중 교사 온폴리시 증류 중심 구조까지 검토하며, 올모 계열 경험과 최신 프런티어 모델 레시피의 차이를 짚는다.

Nathan Lambert
#kimi-k2-5#anthropic#privacy-design#service-design
Hands Free, AIs Forward: NVIDIA XR AI Brings Agents to AR Glasses
Article2026년 6월 16일

Hands Free, AIs Forward: NVIDIA XR AI Brings Agents to AR Glasses

NVIDIA XR AI는 AR 안경과 XR 기기에서 현실 세계를 인식하고 기업 지식과 도구를 활용해 실시간으로 행동을 돕는 멀티모달 AI 에이전트 개발 프레임워크를 공개 베타로 제공한다.

David Chu
#nvidia#ai-architecture#multimodal#agent-routing
How we build evals for Deep Agents
Article2026년 6월 16일

How we build evals for Deep Agents

딥 에이전트 평가는 많은 테스트를 쌓는 것이 아니라, 프로덕션에서 중요한 행동을 직접 측정하는 표적 평가를 설계하고 반복적으로 개선하는 과정이다.

langchain.com
#ai-architecture#llm#semiconductors#applications
HPE AI Factory With NVIDIA Expands for the Era of Agents
Article2026년 6월 16일

HPE AI Factory With NVIDIA Expands for the Era of Agents

NVIDIA와 HPE는 에이전틱 AI가 개념검증을 넘어 운영 단계로 이동하는 흐름에 맞춰 Vera CPU, Agent Toolkit, Confidential Computing, 네트워킹·소프트웨어 통합을 HPE AI Factory 전반으로 확장했다.

Chris Marriott
#nvidia#ai-infrastructure#capex-cycle#llm
Human judgment in the agent improvement loop
Article2026년 6월 16일

Human judgment in the agent improvement loop

AI 에이전트를 신뢰성 있게 개선하려면 조직 안에 문서화된 지식뿐 아니라 직원들의 암묵지와 판단을 개발·평가·운영 전 과정의 자동화된 개선 루프에 반영해야 한다.

langchain.com
#anthropic#ai-architecture#agent-deployment#agent-routing
Hyperscaler Capex to Exceed Cash Flow by Q3 2026
Article2026년 6월 16일

Hyperscaler Capex to Exceed Cash Flow by Q3 2026

Epoch AI는 Microsoft, Amazon, Alphabet, Meta, Oracle의 현금성 자본지출이 영업현금흐름보다 훨씬 빠르게 늘어, 합산 기준으로 2026년 3분기경 영업현금흐름을 넘어설 추세라고 분석한다.

Isabel Juniewicz
#ai-infrastructure#capex-cycle#llm#semiconductors
Introducing container caching in Amazon SageMaker AI for faster model scaling
Article2026년 6월 16일

Introducing container caching in Amazon SageMaker AI for faster model scaling

Amazon SageMaker AI는 추론 엔드포인트의 신규 인스턴스 확장 시 컨테이너 이미지를 미리 캐시해 이미지 다운로드 병목을 제거하고, 생성형 AI 모델의 스케일아웃 지연을 최대 약 2배 단축한다고 발표했습니다.

aws.amazon.com
#model-scaling#service-design#llm#semiconductors
Introducing Firecrawl Keyless: Search, scrape, and interact without an API key
Article2026년 6월 16일

Introducing Firecrawl Keyless: Search, scrape, and interact without an API key

Firecrawl은 API 키 없이 웹 검색, 스크래핑, 페이지 상호작용을 시작할 수 있는 Keyless 기능을 공개하고, 개발자에게 매월 1,000 무료 크레딧을 자동 제공한다고 발표했다.

Eric Ciarla
#openclaw#search-advertising#zero-click-search#llm
LangSmith: Redesigned product homepage and Resource Tags for better organization
Article2026년 6월 16일

LangSmith: Redesigned product homepage and Resource Tags for better organization

LangSmith는 LLM 애플리케이션 개발 흐름을 관찰성, 평가, 프롬프트 엔지니어링으로 재정리한 새 홈페이지와 워크스페이스 리소스 관리를 위한 Resource Tags 개선을 공개했다.

langchain.com
#agent-routing#context-compression#prompt-library#llm
Monte Carlo: Building Data + AI Observability Agents with LangGraph and LangSmith
Article2026년 6월 16일

Monte Carlo: Building Data + AI Observability Agents with LangGraph and LangSmith

Monte Carlo는 LangGraph와 LangSmith를 활용해 기업 데이터 품질 사고를 병렬로 조사하고 근본 원인 분석을 빠르게 수행하는 데이터·AI 관측성 에이전트를 구축했다.

langchain.com
#service-design#ai-architecture#agent-routing#prompt-library
Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI
Article2026년 6월 16일

Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI

P EAGLE은 EAGLE식 추측 디코딩의 순차적 드래프트 병목을 병렬 드래프팅으로 제거해 SageMaker JumpStart에서 지원 모델의 추론 처리량을 높이는 방법입니다.

@https://twitter.com/pymhq
#nvidia#service-design#ai-architecture#agent-deployment
Predicting model behavior before release by simulating deployment
Article2026년 6월 16일

Predicting model behavior before release by simulating deployment

OpenAI는 실제 배포 대화와 유사한 맥락을 후보 모델로 재생성하는 ‘Deployment Simulation’을 통해 출시 전 원치 않는 모델 행동의 발생률과 새로운 위험을 더 현실적으로 예측하려 한다.

openai.com
#openai#privacy-design#agent-deployment#llm
Quickly Start Evaluating LLMs With OpenEvals
Article2026년 6월 16일

Quickly Start Evaluating LLMs With OpenEvals

LangChain 팀은 LLM 애플리케이션과 에이전트를 프로덕션 수준으로 평가하기 쉽게 하기 위해 openevals와 agentevals를 공개하고, 데이터·평가지표·평가 유형별 출발점을 제시한다.

langchain.com
#ai-architecture#context-compression#prompt-library#llm
Reusable Evaluators and Evaluator Templates in LangSmith
Article2026년 6월 16일

Reusable Evaluators and Evaluator Templates in LangSmith

LangSmith Evaluation은 30개 이상의 평가자 템플릿과 재사용 가능한 평가자 관리를 추가해, 에이전트 평가를 온라인 모니터링과 오프라인 실험 전반에서 더 일관되게 운영하도록 한다.

langchain.com
#multimodal#llm#semiconductors#vision-language-models
Safeguard your agentic AI applications with the Amazon Bedrock Guardrails InvokeGuardrailChecks API
Article2026년 6월 16일

Safeguard your agentic AI applications with the Amazon Bedrock Guardrails InvokeGuardrailChecks API

Amazon Bedrock Guardrails의 InvokeGuardrailChecks API는 에이전트형 AI 애플리케이션의 각 단계에서 필요한 안전 점검만 선택적으로 실행하고, 점수 기반 결과를 애플리케이션 로직으로 처리하게 해 주는 감지 전용 API다.

aws.amazon.com
#agent-routing#context-compression#prompt-library#llm
Sharing LangSmith Benchmarks
Article2026년 6월 16일

Sharing LangSmith Benchmarks

LangChain 팀은 LangSmith에서 평가 데이터셋·결과·실행 트레이스를 공유하고, LangChain 문서 Q&A 벤치마크와 langchain benchmarks 패키지로 LLM 애플리케이션 아키텍처를 재현·비교할 수 있게 했다고 설명한다.

langchain.com
#anthropic#ai-architecture#agent-memory#context-compression
Testing Fine Tuned Open Source Models in LangSmith
Article2026년 6월 16일

Testing Fine Tuned Open Source Models in LangSmith

이 글은 LangSmith를 사용해 파인튜닝한 오픈소스 Llama2 모델들을 구조화된 SQL 출력 과제로 평가하고, 모델 크기·학습 데이터·응답 시간·GPT 3.5와의 경쟁력을 비교한 사례를 설명한다.

langchain.com
#ai-architecture#llm#semiconductors#applications
Want to get a data center online quickly? Give it some flex.
Article2026년 6월 16일

Want to get a data center online quickly? Give it some flex.

데이터센터를 더 빨리 가동하기 위한 해법으로 새 발전소 건설만이 아니라, 전력 수요가 치솟는 순간 데이터센터의 소비전력을 낮추는 ‘전력 유연성’이 주목받고 있다.

technologyreview.com
#nvidia#privacy-design#service-design#ai-infrastructure
Why You Should Use Fusion for Better AI Results
YouTube2026년 6월 16일

Why You Should Use Fusion for Better AI Results

Fusion은 하나의 최강 AI 모델에 모든 판단을 맡기기보다 여러 모델의 답을 비교·합성해 Better AI Results를 노리는 방식이다.

Build In Public
#explainer#agent-systems#core-thesis#frontier-model-evaluation
How LangChain Made Coding Agent Spend Predictable
Article2026년 6월 15일

How LangChain Made Coding Agent Spend Predictable

LangChain은 코딩 에이전트 사용량이 전사로 확산되며 예측하기 어려워진 LLM 비용을 LangSmith LLM Gateway로 실시간 가시화하고, 사용자·팀·키 단위 예산과 추적 가능한 제한 워크플로로 관리 가능하게 만들었다.

langchain.com
#agent-routing#llm#semiconductors#applications
이전1…1415161718…5416 / 54다음