Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#llm
Tag1292건YouTube 48Article 1244

#llm

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

Alias / 동의어

large-language-models

연관 태그

#semiconductors공동문서 1040 · 연관도 83%#applications공동문서 974 · 연관도 81%#agent-routing공동문서 512 · 연관도 61%#agent-memory공동문서 468 · 연관도 55%#ai-architecture공동문서 403 · 연관도 51%#privacy-design공동문서 384 · 연관도 50%#context-compression공동문서 342 · 연관도 47%#agent-deployment공동문서 312 · 연관도 47%#service-design공동문서 286 · 연관도 42%#retrieval-index공동문서 213 · 연관도 37%
6 AI Concepts You Must Master to Build Production-Ready AI Systems
Article2026년 6월 18일

6 AI Concepts You Must Master to Build Production-Ready AI Systems

프로덕션 AI 시스템의 핵심 병목은 모델 자체보다 토큰·검색·에이전트 루프·평가·컨텍스트를 어떻게 설계하고 측정하느냐에 있다.

Rahul
#context-window#embedding-search#openai-api#vector-database
An Interview with Michael Morton About E-Commerce in the Age of AI
Article2026년 6월 18일

An Interview with Michael Morton About E-Commerce in the Age of AI

해당 페이지는 Ben Thompson의 Michael Morton 인터뷰를 소개하며, AI 시대의 전자상거래 논점은 제목과 짧은 설명으로만 제시되고 본문 대부분은 Stratechery Plus 구독 안내와 접근 방법으로 구성되어 있습니다.

stratechery.com
#anthropic#service-design#llm#semiconductors
At Cannes Lions, NVIDIA Partners Reshape Advertising and Marketing With AI
Article2026년 6월 18일

At Cannes Lions, NVIDIA Partners Reshape Advertising and Marketing With AI

칸 라이언즈에서 NVIDIA 파트너들은 광고·마케팅의 AI 전환이 단순 채택을 넘어 대규모·실시간·자율 운영을 버틸 인프라 경쟁으로 이동했음을 보여줬다.

Jamie Allan
#nvidia#ai-architecture#multimodal#agent-routing
Beyond LoRA: Can you beat the most popular fine-tuning technique?
Article2026년 6월 18일

Beyond LoRA: Can you beat the most popular fine-tuning technique?

LoRA는 강력하고 대중적인 선택이지만, 동일 조건의 다차원 벤치마크에서는 과제와 우선순위에 따라 다른 PEFT 기법이 더 높은 성능이나 더 낮은 메모리 사용량을 제공할 수 있다.

huggingface.co
#agent-memory#context-compression#retrieval-index#llm
How FERC’s Large-Load Interconnection Actions Help Address Grid Stress, Improve Affordability
Article2026년 6월 18일

How FERC’s Large-Load Interconnection Actions Help Address Grid Stress, Improve Affordability

FERC의 대형 부하 계통 접속 조치는 AI 공장·반도체·첨단 제조 시설을 전력망의 부담이 아니라 비용 분산과 신뢰성 향상에 기여하는 유연한 인프라 자산으로 연결하려는 정책 전환으로 설명된다.

Vladimir Troy
#nvidia#agent-deployment#ai-infrastructure#capex-cycle
France Advances Europe’s AI Future With NVIDIA Technologies
Article2026년 6월 18일

France Advances Europe’s AI Future With NVIDIA Technologies

프랑스는 NVIDIA 기술을 기반으로 AI 공장, 개방형 모델, 산업용 AI 적용을 실제 운영 단계로 끌어올리며 유럽 AI 인프라의 핵심 거점으로 부상하고 있다.

Nat Ives
#europe#nvidia#privacy-design#multimodal
Improving health intelligence in ChatGPT
Article2026년 6월 18일

Improving health intelligence in ChatGPT

OpenAI는 GPT‑5.5 Instant가 의사 주도 평가와 모델 성능 향상을 바탕으로 ChatGPT의 건강 관련 답변에서 정확성, 안전성, 맥락 파악, 불확실성 설명, 진료 권고 판단을 크게 개선했다고 설명한다.

openai.com
#openai#privacy-design#ai-safety#llm
Introducing LangSmith’s No Code Agent Builder
Article2026년 6월 18일

Introducing LangSmith’s No Code Agent Builder

LangSmith Agent Builder는 개발자가 아닌 비즈니스 사용자도 대화형 안내, 메모리, 도구 연결, 트리거 설정을 통해 코드 없이 에이전트를 만들 수 있도록 설계된 비공개 프리뷰 기능이다.

langchain.com
#agent-memory#agent-routing#context-compression#prompt-library
Is it agentic enough? Benchmarking open models on your own tooling
Article2026년 6월 18일

Is it agentic enough? Benchmarking open models on your own tooling

이 글은 transformers를 사례로, 오픈 모델 기반 코딩 에이전트가 도구를 얼마나 쉽게 발견하고 사용하며 정답에 도달하는지 과정을 중심으로 측정하는 벤치마크 방법을 제시한다.

huggingface.co
#agent-routing#workflow-automation#llm#semiconductors
Monitor and debug generative AI inference with SageMaker detailed metrics and Insights dashboard on CloudWatch
Article2026년 6월 18일

Monitor and debug generative AI inference with SageMaker detailed metrics and Insights dashboard on CloudWatch

SageMaker AI의 상세 추론 지표와 CloudWatch의 SageMaker Insights 대시보드는 대규모 생성형 AI 추론 엔드포인트의 지연, 용량, 안정성 문제를 더 빠르게 모니터링하고 진단하도록 돕는다.

aws.amazon.com
#service-design#ai-architecture#agent-memory#context-compression
MosaicLeaks: Can your research agent keep a secret?
Article2026년 6월 18일

MosaicLeaks: Can your research agent keep a secret?

MosaicLeaks는 딥 리서치 에이전트의 외부 웹 쿼리 로그가 사적 문서의 정보를 조각조각 누출할 수 있음을 보이고, 쿼리 구성 방식에 보상 신호를 주는 PA DR이 성능을 유지하면서 누출을 크게 줄인다는 결과를 제시한다.

huggingface.co
#privacy-design#agent-deployment#prompt-library#search-advertising
This Is What Happens When You CRUSH An AI Video Model
YouTube2026년 6월 18일

This Is What Happens When You CRUSH An AI Video Model

AI Video Model을 과도하게 압축하면 단순히 해상도가 낮아지는 수준이 아니라, 포맷 선택·인물 정체성·오디오 신뢰도까지 함께 무너지며 실전 기준은 대체로 Q4와 Q8 계열의 균형점에 있다.

Alex Ziskind
#explainer#core-thesis#anthropic-model-roadmap#frontier-model-evaluation
Agentic Resource Discovery: Let agents search
Article2026년 6월 17일

Agentic Resource Discovery: Let agents search

Agentic Resource Discovery(ARD)는 에이전트가 도구·스킬·다른 에이전트를 미리 설치하지 않고도 실행 시점에 검색해 발견하도록 하는 공개 표준이며, Hugging Face는 이를 Discover Tool로 구현했습니다.

huggingface.co
#service-design#ai-distribution#search-advertising#zero-click-search
Anthropic opens Seoul office
Article2026년 6월 17일

Anthropic opens Seoul office

Anthropic은 서울 사무소 개소와 함께 한국 정부, 대기업, 스타트업, 연구기관, 비영리 부문과의 협력을 발표하며 한국 AI 생태계에서 Claude 활용과 AI 안전 협력을 확대하겠다고 밝혔다.

anthropic.com
#anthropic#service-design#agent-routing#ai-safety
From the Hugging Face Hub to robot hardware with Strands Agents and LeRobot
Article2026년 6월 17일

From the Hugging Face Hub to robot hardware with Strands Agents and LeRobot

이 글은 Strands Robots가 LeRobot 데이터셋, 시뮬레이션, 정책 실행, 하드웨어 경로를 하나의 에이전트 루프로 묶어 Hugging Face Hub의 데모 데이터에서 실제 로봇 실행까지 이어지는 흐름을 설명한다.

huggingface.co
#anthropic#service-design#agent-deployment#agent-routing
GLM-5.2: Built for Long-Horizon Tasks
Article2026년 6월 17일

GLM-5.2: Built for Long-Horizon Tasks

GLM 5.2는 안정적인 100만 토큰 문맥, 강화된 코딩 성능, 효율적인 장문맥 구조와 서빙·강화학습 체계를 결합해 장시간 수행되는 복잡한 엔지니어링 작업을 겨냥한 공개형 주력 모델이다.

huggingface.co
#service-design#ai-architecture#agent-routing#llm
Introducing Firecrawl Research Index: a specialized index for agentic AI/ML research
Article2026년 6월 17일

Introducing Firecrawl Research Index: a specialized index for agentic AI/ML research

Firecrawl은 AI/ML 연구 에이전트가 논문과 구현 코드를 함께 검색·검증·활용할 수 있도록 특화된 Firecrawl Research Index를 공개했다.

Eric Ciarla
#ai-distribution#search-advertising#zero-click-search#llm
A near-autonomous AI chemist improves a challenging reaction in medicinal chemistry
Article2026년 6월 17일

A near-autonomous AI chemist improves a challenging reaction in medicinal chemistry

GPT‑5.4와 Molecule.one의 자율실험 시스템 Maria를 결합한 연구에서, TEMPO 계열 첨가제가 난도가 높은 1차 설폰아마이드 Chan–Lam 결합의 수율을 다양한 기질 조합에서 개선했으며 사람의 실험실 재현으로도 효과가 확인됐다.

openai.com
#openai#privacy-design#agent-routing#llm
Amazon SageMaker AI Async Inference now supports inline request payloads
Article2026년 6월 17일

Amazon SageMaker AI Async Inference now supports inline request payloads

Amazon SageMaker AI Async Inference가 InvokeEndpointAsync 요청 본문에 최대 128,000바이트 payload를 직접 담는 Body 파라미터를 지원해, 작은 입력에 대해 매번 S3에 업로드하던 단계를 없앴습니다.

aws.amazon.com
#service-design#ai-architecture#agent-routing#llm
State of the blog
Article2026년 6월 17일

State of the blog

네이선 램버트는 인터커넥츠를 프런티어 인공지능 논의의 독립적이고 기술적인 대화 공간으로 유지하면서, 공개 생태계 구축이라는 자신의 경력 목표와 더 긴밀히 연결하겠다고 설명한다.

Nathan Lambert
#privacy-design#llm#semiconductors#applications
Toward an O*NET for AI R&D
Article2026년 6월 17일

Toward an O*NET for AI R&D

이 글은 AI 연구개발 자동화를 더 정확히 예측하려면 계산량·벤치마크 같은 간접 지표만 보지 말고, 실제 AI R&D 업무를 세분화한 ‘AI R&D용 O NET’이 필요하다고 제안한다.

Jean-Stanislas Denain
#anthropic#privacy-design#agent-routing#llm
Transcript: ‘Can GitHub Be for Everyone?’
Article2026년 6월 17일

Transcript: ‘Can GitHub Be for Everyone?’

GitHub COO 카일 데이글은 AI 에이전트 확산으로 개발자와 비개발자의 경계가 넓어지는 가운데, GitHub가 개발자 선택권과 오픈소스 유지관리자의 통제권을 중심에 두고 제품·비즈니스·마이크로소프트 개발자 전략을 조정하고 있다고 설명한다.

Mike Taylor
#anthropic#privacy-design#agent-routing#change-management
I Don''t Prompt AI Anymore. I Do LOOPING.
YouTube2026년 6월 17일

I Don''t Prompt AI Anymore. I Do LOOPING.

Prompt AI를 매번 반복하는 방식보다, 목표·검증·수정이 이어지는 LOOPING 설계가 AI 개발 워크플로의 핵심으로 떠오르고 있다는 메시지다.

Build In Public
#explainer#agent-systems#core-thesis#anthropic-model-roadmap
Why Fleet Has General Purpose Chat and Specialized Agents
Article2026년 6월 16일

Why Fleet Has General Purpose Chat and Specialized Agents

Fleet은 일회성·탐색형 업무에는 General Purpose Chat을, 반복적으로 맡겨야 하는 업무에는 지속 설정과 메모리를 갖춘 Specialized Agents를 쓰도록 두 에이전트 유형을 구분한다.

langchain.com
#agent-memory#agent-routing#context-compression#retrieval-index
이전1…1314151617…5415 / 54다음