Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#agent-deployment
Tag356건Article 356

#agent-deployment

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#applications공동문서 319 · 연관도 50%#llm공동문서 327 · 연관도 46%#semiconductors공동문서 308 · 연관도 46%#agent-routing공동문서 126 · 연관도 28%#agent-memory공동문서 103 · 연관도 23%#context-compression공동문서 82 · 연관도 21%#service-design공동문서 74 · 연관도 20%#privacy-design공동문서 75 · 연관도 18%#ai-architecture공동문서 78 · 연관도 18%#workflow-automation공동문서 40 · 연관도 17%
Temporary Cloudflare Accounts for AI agents
Article2026년 6월 19일

Temporary Cloudflare Accounts for AI agents

Cloudflare는 AI 에이전트가 계정 가입·브라우저 인증 없이 Wrangler의 temporary 옵션으로 즉시 배포하고 60분 안에 사람이 계정을 소유권 이전할 수 있는 임시 계정 기능을 공개했다.

blog.cloudflare.com
#agent-deployment#llm#semiconductors#applications
Beyond LoRA: Can you beat the most popular fine-tuning technique?
Article2026년 6월 18일

Beyond LoRA: Can you beat the most popular fine-tuning technique?

LoRA는 강력하고 대중적인 선택이지만, 동일 조건의 다차원 벤치마크에서는 과제와 우선순위에 따라 다른 PEFT 기법이 더 높은 성능이나 더 낮은 메모리 사용량을 제공할 수 있다.

huggingface.co
#agent-memory#context-compression#retrieval-index#llm
How FERC’s Large-Load Interconnection Actions Help Address Grid Stress, Improve Affordability
Article2026년 6월 18일

How FERC’s Large-Load Interconnection Actions Help Address Grid Stress, Improve Affordability

FERC의 대형 부하 계통 접속 조치는 AI 공장·반도체·첨단 제조 시설을 전력망의 부담이 아니라 비용 분산과 신뢰성 향상에 기여하는 유연한 인프라 자산으로 연결하려는 정책 전환으로 설명된다.

Vladimir Troy
#nvidia#agent-deployment#ai-infrastructure#capex-cycle
France Advances Europe’s AI Future With NVIDIA Technologies
Article2026년 6월 18일

France Advances Europe’s AI Future With NVIDIA Technologies

프랑스는 NVIDIA 기술을 기반으로 AI 공장, 개방형 모델, 산업용 AI 적용을 실제 운영 단계로 끌어올리며 유럽 AI 인프라의 핵심 거점으로 부상하고 있다.

Nat Ives
#europe#nvidia#privacy-design#multimodal
MosaicLeaks: Can your research agent keep a secret?
Article2026년 6월 18일

MosaicLeaks: Can your research agent keep a secret?

MosaicLeaks는 딥 리서치 에이전트의 외부 웹 쿼리 로그가 사적 문서의 정보를 조각조각 누출할 수 있음을 보이고, 쿼리 구성 방식에 보상 신호를 주는 PA DR이 성능을 유지하면서 누출을 크게 줄인다는 결과를 제시한다.

huggingface.co
#privacy-design#agent-deployment#prompt-library#search-advertising
Bringing more agent harnesses and frameworks to Cloudflare, starting with Flue
Article2026년 6월 17일

Bringing more agent harnesses and frameworks to Cloudflare, starting with Flue

Cloudflare는 Flue를 첫 사례로 삼아 에이전트 프레임워크·하네스·런타임의 3계층 구조와 Agents SDK가 제공하는 durable execution, 코드 실행, durable filesystem 같은 생산용 기반 요소를 설명한다.

blog.cloudflare.com
#service-design#agent-deployment#agent-routing#llm
From the Hugging Face Hub to robot hardware with Strands Agents and LeRobot
Article2026년 6월 17일

From the Hugging Face Hub to robot hardware with Strands Agents and LeRobot

이 글은 Strands Robots가 LeRobot 데이터셋, 시뮬레이션, 정책 실행, 하드웨어 경로를 하나의 에이전트 루프로 묶어 Hugging Face Hub의 데모 데이터에서 실제 로봇 실행까지 이어지는 흐름을 설명한다.

huggingface.co
#anthropic#service-design#agent-deployment#agent-routing
Introducing the Cloudflare One stack- agent-powered deployment
Article2026년 6월 17일

Introducing the Cloudflare One stack- agent-powered deployment

Cloudflare One stack은 에이전트가 Zero Trust 환경을 이해하고 구성·배포·관리하도록 Cloudflare의 운영 지식과 마이그레이션 절차를 기술 파일 형태로 제공하는 도구 묶음이다.

blog.cloudflare.com
#service-design#ai-architecture#agent-deployment#agent-routing
Pro-worker AI, explained
Article2026년 6월 17일

Pro-worker AI, explained

MIT Sloan 글은 AI를 사람을 대체하는 자동화 도구가 아니라 인간의 판단·전문성·새로운 과업 수행 능력을 키우는 방향으로 설계해야 한다고 설명한다.

mitsloan.mit.edu
#service-design#semiconductors#applications#compute
Toward an O*NET for AI R&D
Article2026년 6월 17일

Toward an O*NET for AI R&D

이 글은 AI 연구개발 자동화를 더 정확히 예측하려면 계산량·벤치마크 같은 간접 지표만 보지 말고, 실제 AI R&D 업무를 세분화한 ‘AI R&D용 O NET’이 필요하다고 제안한다.

Jean-Stanislas Denain
#anthropic#privacy-design#agent-routing#llm
Toward an O*NET for AI R&D
Article2026년 6월 17일

Toward an O*NET for AI R&D

이 글은 AI 연구개발 자동화를 더 정확히 예측하려면 계산량·벤치마크 같은 간접 지표만 보지 말고, 실제 AI R&D 업무를 세분화한 ‘AI R&D용 O NET’이 필요하다고 제안한다.

Jean-Stanislas Denain
#anthropic#privacy-design#agent-routing#llm
Why Fleet Has General Purpose Chat and Specialized Agents
Article2026년 6월 16일

Why Fleet Has General Purpose Chat and Specialized Agents

Fleet은 일회성·탐색형 업무에는 General Purpose Chat을, 반복적으로 맡겨야 하는 업무에는 지속 설정과 메모리를 갖춘 Specialized Agents를 쓰도록 두 에이전트 유형을 구분한다.

langchain.com
#agent-memory#agent-routing#context-compression#retrieval-index
Context Management for Deep Agents
Article2026년 6월 16일

Context Management for Deep Agents

Deep Agents SDK는 장기 작업에서 모델의 제한된 컨텍스트 창을 넘지 않도록 파일시스템 오프로딩과 요약을 결합해 필요한 정보를 보존하면서 작업 기억을 압축한다.

langchain.com
#ai-architecture#llm#semiconductors#applications
How Factory used LangSmith to automate their feedback loop and improve iteration speed by 2x
Article2026년 6월 16일

How Factory used LangSmith to automate their feedback loop and improve iteration speed by 2x

Factory는 Self hosted LangSmith로 보안 요구를 지키면서 LLM 워크플로 관측성과 피드백 루프를 자동화해 프롬프트 개선과 제품 반복 속도를 2배 높였다.

langchain.com
#privacy-design#agent-deployment#agent-routing#workflow-automation
How we build evals for Deep Agents
Article2026년 6월 16일

How we build evals for Deep Agents

딥 에이전트 평가는 많은 테스트를 쌓는 것이 아니라, 프로덕션에서 중요한 행동을 직접 측정하는 표적 평가를 설계하고 반복적으로 개선하는 과정이다.

langchain.com
#ai-architecture#llm#semiconductors#applications
HPE AI Factory With NVIDIA Expands for the Era of Agents
Article2026년 6월 16일

HPE AI Factory With NVIDIA Expands for the Era of Agents

NVIDIA와 HPE는 에이전틱 AI가 개념검증을 넘어 운영 단계로 이동하는 흐름에 맞춰 Vera CPU, Agent Toolkit, Confidential Computing, 네트워킹·소프트웨어 통합을 HPE AI Factory 전반으로 확장했다.

Chris Marriott
#nvidia#ai-infrastructure#capex-cycle#llm
Human judgment in the agent improvement loop
Article2026년 6월 16일

Human judgment in the agent improvement loop

AI 에이전트를 신뢰성 있게 개선하려면 조직 안에 문서화된 지식뿐 아니라 직원들의 암묵지와 판단을 개발·평가·운영 전 과정의 자동화된 개선 루프에 반영해야 한다.

langchain.com
#anthropic#ai-architecture#agent-deployment#agent-routing
LangSmith: Redesigned product homepage and Resource Tags for better organization
Article2026년 6월 16일

LangSmith: Redesigned product homepage and Resource Tags for better organization

LangSmith는 LLM 애플리케이션 개발 흐름을 관찰성, 평가, 프롬프트 엔지니어링으로 재정리한 새 홈페이지와 워크스페이스 리소스 관리를 위한 Resource Tags 개선을 공개했다.

langchain.com
#agent-routing#context-compression#prompt-library#llm
Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI
Article2026년 6월 16일

Parallelize speculative decoding with P-EAGLE on Amazon SageMaker AI

P EAGLE은 EAGLE식 추측 디코딩의 순차적 드래프트 병목을 병렬 드래프팅으로 제거해 SageMaker JumpStart에서 지원 모델의 추론 처리량을 높이는 방법입니다.

@https://twitter.com/pymhq
#nvidia#service-design#ai-architecture#agent-deployment
Predicting model behavior before release by simulating deployment
Article2026년 6월 16일

Predicting model behavior before release by simulating deployment

OpenAI는 실제 배포 대화와 유사한 맥락을 후보 모델로 재생성하는 ‘Deployment Simulation’을 통해 출시 전 원치 않는 모델 행동의 발생률과 새로운 위험을 더 현실적으로 예측하려 한다.

openai.com
#openai#privacy-design#agent-deployment#llm
Quickly Start Evaluating LLMs With OpenEvals
Article2026년 6월 16일

Quickly Start Evaluating LLMs With OpenEvals

LangChain 팀은 LLM 애플리케이션과 에이전트를 프로덕션 수준으로 평가하기 쉽게 하기 위해 openevals와 agentevals를 공개하고, 데이터·평가지표·평가 유형별 출발점을 제시한다.

langchain.com
#ai-architecture#context-compression#prompt-library#llm
Reusable Evaluators and Evaluator Templates in LangSmith
Article2026년 6월 16일

Reusable Evaluators and Evaluator Templates in LangSmith

LangSmith Evaluation은 30개 이상의 평가자 템플릿과 재사용 가능한 평가자 관리를 추가해, 에이전트 평가를 온라인 모니터링과 오프라인 실험 전반에서 더 일관되게 운영하도록 한다.

langchain.com
#multimodal#llm#semiconductors#vision-language-models
Safeguard your agentic AI applications with the Amazon Bedrock Guardrails InvokeGuardrailChecks API
Article2026년 6월 16일

Safeguard your agentic AI applications with the Amazon Bedrock Guardrails InvokeGuardrailChecks API

Amazon Bedrock Guardrails의 InvokeGuardrailChecks API는 에이전트형 AI 애플리케이션의 각 단계에서 필요한 안전 점검만 선택적으로 실행하고, 점수 기반 결과를 애플리케이션 로직으로 처리하게 해 주는 감지 전용 API다.

aws.amazon.com
#agent-routing#context-compression#prompt-library#llm
Testing Fine Tuned Open Source Models in LangSmith
Article2026년 6월 16일

Testing Fine Tuned Open Source Models in LangSmith

이 글은 LangSmith를 사용해 파인튜닝한 오픈소스 Llama2 모델들을 구조화된 SQL 출력 과제로 평가하고, 모델 크기·학습 데이터·응답 시간·GPT 3.5와의 경쟁력을 비교한 사례를 설명한다.

langchain.com
#ai-architecture#llm#semiconductors#applications
이전1…34567…155 / 15다음