Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#llm
Tag1292건YouTube 48Article 1244

#llm

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

Alias / 동의어

large-language-models

연관 태그

#semiconductors공동문서 1040 · 연관도 83%#applications공동문서 974 · 연관도 81%#agent-routing공동문서 512 · 연관도 61%#agent-memory공동문서 468 · 연관도 55%#ai-architecture공동문서 403 · 연관도 51%#privacy-design공동문서 384 · 연관도 50%#context-compression공동문서 342 · 연관도 47%#agent-deployment공동문서 312 · 연관도 47%#service-design공동문서 286 · 연관도 42%#retrieval-index공동문서 213 · 연관도 37%
How Dub Builds AI Affiliate Landing Pages with Firecrawl
Article2025년 8월 13일

How Dub Builds AI Affiliate Landing Pages with Firecrawl

Dub는 Firecrawl로 회사 웹사이트의 지저분한 웹 데이터를 깨끗한 마크다운으로 변환해, 몇 초 만에 제휴 프로그램 랜딩 페이지를 만드는 AI 페이지 빌더를 구현했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
TextQuests: How Good are LLMs at Text-Based Video Games?
Article2025년 8월 13일

TextQuests: How Good are LLMs at Text-Based Video Games?

TextQuests는 25개의 고전 텍스트 어드벤처 게임을 통해 LLM 에이전트의 장기 문맥 추론, 탐색 학습, 공간 이해, 행동 효율성과 유해 행동 경향을 평가하는 벤치마크다.

huggingface.co
#token-efficiency#llm#semiconductors#applications
Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training
Article2025년 8월 12일

Accelerate ND-Parallel: A guide to Efficient Multi-GPU Training

Accelerate와 Axolotl은 데이터·완전 샤딩 데이터·텐서·컨텍스트 병렬화를 조합해 대규모 모델의 메모리 사용량, 계산량, 장치 간 통신 비용을 균형 있게 설계하도록 지원한다.

huggingface.co
#ai-architecture#agent-memory#agent-routing#capex-cycle
Basis scales accounting by turning OpenAI model progress into trusted agents
Article2025년 8월 12일

Basis scales accounting by turning OpenAI model progress into trusted agents

베이시스는 업무별로 적합한 오픈AI 모델을 배치하고 판단 근거를 검토 가능하게 공개함으로써, 회계 자동화를 신뢰할 수 있는 업무 위임 체계로 확장하고 있다.

openai.com
#openai#ai-architecture#agent-routing#workflow-automation
Enabling physician-centered oversight for AMIE
Article2025년 8월 12일

Enabling physician-centered oversight for AMIE

g AMIE는 환자 문진과 의료 기록 초안을 맡되 개별화된 의학적 조언은 금지하고, 최종 판단과 환자 전달은 감독 의사가 검토·수정하도록 설계된 AMIE의 의사 중심 감독 연구 프레임워크다.

research.google
#agent-routing#llm#semiconductors#applications
OpenAI’s letter to Governor Newsom on harmonized regulation
Article2025년 8월 12일

OpenAI’s letter to Governor Newsom on harmonized regulation

OpenAI는 캘리포니아가 주별 AI 규제의 중복과 불일치를 줄이고, 연방·국제 안전 기준과 조화된 국가적 모델을 이끌어야 한다고 Newsom 주지사에게 촉구했다.

openai.com
#openai#privacy-design#ai-safety#llm
Achieving 10,000x training data reduction with high-fidelity labels
Article2025년 8월 7일

Achieving 10,000x training data reduction with high-fidelity labels

Google Ads 연구진은 광고 안전성 분류에서 전문가 고품질 라벨과 능동학습 기반 큐레이션을 결합해 LLM 미세조정에 필요한 학습 데이터를 100,000건에서 500건 미만으로 줄이면서 인간 전문가와의 정렬도를 높였다고 설명한다.

research.google
#privacy-design#ai-distribution#search-advertising#zero-click-search
Introducing GPT‑5 for developers
Article2025년 8월 7일

Introducing GPT‑5 for developers

GPT‑5는 코딩 정확도와 도구 호출, 지시 이행, 장문 맥락 검색을 함께 개선하고 개발자가 응답 방식과 추론 수준을 조절할 수 있게 설계된 OpenAI의 API용 추론 모델이다.

openai.com
#openai#long-context#privacy-design#service-design
Introducing GPT-5
Article2025년 8월 7일

Introducing GPT-5

GPT‑5는 빠른 응답과 심층 추론을 실시간으로 조합해 코딩·수학·글쓰기·건강·멀티모달 과제의 성능을 높이고, 환각과 과도한 확신을 줄인 OpenAI의 통합형 AI 시스템이다.

openai.com
#openai#privacy-design#multimodal#ai-safety
Announcing NeurIPS 2025 E2LM Competition: Early Training Evaluation of Language Models
Article2025년 8월 5일

Announcing NeurIPS 2025 E2LM Competition: Early Training Evaluation of Language Models

NeurIPS 2025 E2LM Competition은 LLM 초기 학습 단계에서 과학 지식과 추론 신호를 더 잘 포착하는 벤치마크를 함께 만들기 위한 대회다.

huggingface.co
#e2lm-competition#hugging-face#lm-evaluation-harness#llm
gpt-oss-120b & gpt-oss-20b Model Card
Article2025년 8월 5일

gpt-oss-120b & gpt-oss-20b Model Card

OpenAI는 gpt oss 120b와 gpt oss 20b를 공개 가중치 추론 모델로 소개하며, 에이전트형 워크플로와 도구 사용을 지원하되 공개 모델 특유의 안전 위험과 평가 결과를 함께 제시했다.

openai.com
#openai#privacy-design#agent-deployment#agent-routing
Introducing gpt-oss
Article2025년 8월 5일

Introducing gpt-oss

오픈AI는 높은 추론·도구 사용 성능과 효율적인 로컬 실행을 결합한 아파치 2.0 기반 오픈 웨이트 모델 gpt oss 120b와 gpt oss 20b를 공개했다.

openai.com
#ai-architecture#multimodal#agent-memory#agent-routing
Estimating worst case frontier risks of open weight LLMs
Article2025년 8월 5일

Estimating worst case frontier risks of open weight LLMs

OpenAI는 gpt oss 공개 전 생물·사이버보안 영역에서 악의적 미세조정으로 최악의 위험을 추정했으며, 평가 결과 기존 최전선 모델을 넘어서지는 않는다고 밝혔다.

openai.com
#openai#gpt-oss#openai-o3#preparedness-high
Open weights and AI for all
Article2025년 8월 5일

Open weights and AI for all

OpenAI는 고도화된 오픈 웨이트 추론 모델을 공개해 개인·비영리단체·기업·정부가 자체 인프라에서 인공지능을 실행하고 맞춤화하도록 지원하며, 이를 민주적 가치에 기반한 인공지능 생태계의 확산과 연결한다.

openai.com
#openai#privacy-design#service-design#ai-safety
How hard is it to migrate AWAY from Convex?
Article2025년 8월 4일

How hard is it to migrate AWAY from Convex?

저자는 Convex에서 벗어나는 난이도를 직접 검증하기 위해 간단한 Tanstack Start 예제를 기준으로 함수, 클라이언트 호출, 반응형 쿼리, 데이터베이스 이전을 차례로 Tanstack Start와 Drizzle/Postgres로 옮겨 보며 실제 작업량과 복잡도 변화를 살펴본다.

stack.convex.dev
#service-design#ai-architecture#agent-memory#agent-routing
Measuring Open-Source Llama Nemotron Models on DeepResearch Bench
Article2025년 8월 4일

Measuring Open-Source Llama Nemotron Models on DeepResearch Bench

NVIDIA의 개방형 딥리서치 에이전트 AI Q는 두 Llama 계열 모델과 검색·오케스트레이션 도구를 결합해 2025년 8월 DeepResearch Bench의 ‘LLM with Search’ 부문에서 종합 40.52점을 기록했다.

huggingface.co
#privacy-design#ai-architecture#search-advertising#workflow-automation
Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio
Article2025년 7월 31일

Implementing MCP Servers in Python: An AI Shopping Assistant with Gradio

Gradio의 MCP 통합을 이용해 웹 탐색 도구와 IDM VTON 가상 피팅 모델을 연결하고, VS Code AI 채팅에서 사용할 수 있는 개인용 AI 쇼핑 도우미를 구현하는 방법을 설명한다.

huggingface.co
#llm#semiconductors#applications#agent-memory
Introducing AI Sheets: a tool to work with datasets using open AI models!
Article2025년 7월 31일

Introducing AI Sheets: a tool to work with datasets using open AI models!

Hugging Face AI Sheets는 스프레드시트형 인터페이스에서 프롬프트와 공개 AI 모델을 활용해 데이터셋을 만들고, 변환하고, 보강하고, 평가할 수 있게 해주는 오픈소스 노코드 도구다.

huggingface.co
#privacy-design#context-compression#prompt-library#llm
Introducing Stargate Norway
Article2025년 7월 31일

Introducing Stargate Norway

OpenAI는 노르웨이 나르비크에 재생에너지 기반의 대규모 AI 데이터센터를 조성해 유럽의 컴퓨팅 역량과 지역 AI 생태계를 확대하는 ‘스타게이트 노르웨이’ 계획을 발표했다.

openai.com
#nvidia#openai#privacy-design#ai-infrastructure
Lessons from Building an AI App Builder on Convex
Article2025년 7월 31일

Lessons from Building an AI App Builder on Convex

Chef의 사례는 AI 코딩 에이전트가 잘 작동하려면 좋은 추상화, 제한된 선택지, 타입 안전한 피드백 루프, 검증 가능한 평가 체계가 필요하다는 점을 보여준다.

stack.convex.dev
#ai-architecture#agent-routing#context-compression#prompt-library
Intercom's three lessons for creating a sustainable AI advantage
Article2025년 7월 30일

Intercom's three lessons for creating a sustainable AI advantage

인터콤은 조기 실험으로 모델 이해도를 높이고, 엄격한 평가로 도입 속도를 끌어올리며, 모델 교체가 쉬운 유연한 아키텍처를 구축해 지속 가능한 인공지능 경쟁력을 만들었다.

openai.com
#openai#privacy-design#service-design#ai-architecture
Benchmarking Language Model Performance on 5th Gen Xeon at GCP
Article2025년 7월 29일

Benchmarking Language Model Performance on 5th Gen Xeon at GCP

Google Cloud의 5세대 Xeon 기반 C4 인스턴스는 3세대 Xeon 기반 N2보다 텍스트 임베딩과 텍스트 생성에서 큰 처리량 및 비용 효율 우위를 보이며, 경량 에이전틱 AI를 CPU만으로 배포할 가능성을 보여준다.

huggingface.co
#llm#semiconductors#applications#long-context
Introducing Trackio: A Lightweight Experiment Tracking Library from Hugging Face
Article2025년 7월 29일

Introducing Trackio: A Lightweight Experiment Tracking Library from Hugging Face

트래키오는 로컬 대시보드, 허깅페이스 스페이스 공유, 기존 wandb 호환 API를 결합한 무료 오픈소스 실험 추적 파이썬 라이브러리다.

huggingface.co
#nvidia#agent-routing#ai-infrastructure#capex-cycle
Prefill and Decode for Concurrent Requests - Optimizing LLM Performance
Article2025년 7월 28일

Prefill and Decode for Concurrent Requests - Optimizing LLM Performance

동시 요청을 처리하는 LLM 추론에서는 프리필과 디코드의 계산 특성이 달라, 첫 토큰 지연·토큰 생성 지연·총처리량·GPU 활용률 사이의 균형에 맞춰 배칭과 프리필 청크 크기를 조정해야 한다.

huggingface.co
#agent-memory#agent-routing#retrieval-index#workflow-automation
이전1…4243444546…5444 / 54다음