Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#llm
Tag1292건YouTube 48Article 1244

#llm

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

Alias / 동의어

large-language-models

연관 태그

#semiconductors공동문서 1040 · 연관도 83%#applications공동문서 974 · 연관도 81%#agent-routing공동문서 512 · 연관도 61%#agent-memory공동문서 468 · 연관도 55%#ai-architecture공동문서 403 · 연관도 51%#privacy-design공동문서 384 · 연관도 50%#context-compression공동문서 342 · 연관도 47%#agent-deployment공동문서 312 · 연관도 47%#service-design공동문서 286 · 연관도 42%#retrieval-index공동문서 213 · 연관도 37%
(LoRA) Fine-Tuning FLUX.1-dev on Consumer Hardware
Article2025년 6월 1일

(LoRA) Fine-Tuning FLUX.1-dev on Consumer Hardware

FLUX.1 dev의 트랜스포머를 4비트로 양자화하고 LoRA, 8비트 옵티마이저, 체크포인팅, 잠재 표현·텍스트 임베딩 캐시를 결합해 단일 GPU에서 약 10GB 미만의 VRAM으로 미세 조정하는 방법을 설명한다.

huggingface.co
#ai-architecture#agent-memory#capex-cycle#context-compression
Creating websites in minutes with AI Website Builder
Article2025년 5월 29일

Creating websites in minutes with AI Website Builder

Wix는 OpenAI 모델과 자사의 웹사이트 제작 경험을 결합해, 사용자가 대화만으로 콘텐츠·이미지·레이아웃·업무 기능을 갖춘 웹사이트를 몇 분 안에 만들 수 있도록 했다.

openai.com
#openai#privacy-design#context-compression#prompt-library
CodeAgents + Structure: A Better Way to Execute Actions
Article2025년 5월 28일

CodeAgents + Structure: A Better Way to Execute Actions

이 글은 CodeAgent의 유연한 코드 실행 방식에 구조화된 JSON 출력을 결합하면, 충분히 강한 모델에서 파싱 안정성과 추론 명시성이 높아져 여러 벤치마크 성능이 개선된다고 설명한다.

huggingface.co
#anthropic#agent-routing#llm#semiconductors
Introducing AutoRound: Intel’s Advanced Quantization for LLMs and VLMs
Article2025년 5월 27일

Introducing AutoRound: Intel’s Advanced Quantization for LLMs and VLMs

AutoRound는 가중치 반올림과 클리핑 범위를 함께 최적화해 낮은 비트에서도 정확도를 유지하면서 빠른 양자화와 폭넓은 모델·장치·출력 형식 호환성을 제공하는 인텔의 가중치 전용 학습 후 양자화 도구다.

huggingface.co
#multimodal#agent-deployment#ai-infrastructure#capex-cycle
Dell Enterprise Hub is all you need to build AI on premises
Article2025년 5월 23일

Dell Enterprise Hub is all you need to build AI on premises

Dell Enterprise Hub의 새 버전은 Dell AI 서버와 AI PC에서 모델, 애플리케이션, 온디바이스 AI, SDK/CLI를 온프레미스로 빠르게 배포하도록 묶은 엔터프라이즈 AI 툴킷으로 소개된다.

huggingface.co
#nvidia#agent-deployment#ai-infrastructure#capex-cycle
Shipping code faster with o3, o4-mini, and GPT-4.1
Article2025년 5월 22일

Shipping code faster with o3, o4-mini, and GPT-4.1

CodeRabbit은 코드 생성량이 아니라 리뷰 처리량이 실제 배포 속도를 제한한다는 문제의식에서 출발해, 저장소 맥락을 보강한 다단계 AI 리뷰로 정확하고 신속한 코드 배포를 지원한다.

openai.com
#agent-deployment#agent-routing#llm#semiconductors
Welcome Llama 4 Maverick & Scout on Hugging Face
Article2025년 5월 22일

Welcome Llama 4 Maverick & Scout on Hugging Face

Meta의 네이티브 멀티모달 MoE 모델 Llama 4 Maverick과 Scout가 출시 당일부터 Hugging Face Hub, Transformers, TGI, 양자화 및 Xet 저장소를 통해 제공되며, 최대 1천만 토큰 문맥과 강력한 추론·이미지·코딩 성능을 지원한다.

huggingface.co
#ai-architecture#multimodal#agent-deployment#agent-routing
New tools and features in the Responses API
Article2025년 5월 21일

New tools and features in the Responses API

OpenAI는 Responses API에 원격 MCP, 이미지 생성, 코드 인터프리터 등 새 도구와 장기 작업·추론 관리 기능을 추가해 에이전트 애플리케이션의 활용성, 신뢰성, 가시성, 개인정보 보호를 강화했다.

openai.com
#privacy-design#ai-safety#llm#semiconductors
Introducing Codex
Article2025년 5월 16일

Introducing Codex

코덱스는 저장소별 격리 환경에서 여러 소프트웨어 개발 작업을 병렬로 수행하고, 코드 변경과 테스트 결과를 검증 가능한 근거와 함께 제시하는 클라우드 기반 소프트웨어 엔지니어링 에이전트다.

openai.com
#openai#privacy-design#agent-routing#llm
The Transformers Library: standardizing model definitions
Article2025년 5월 15일

The Transformers Library: standardizing model definitions

트랜스포머스는 모델 정의를 표준화해 하나의 아키텍처 구현이 학습·추론·배포·로컬 실행 도구 전반으로 빠르게 이어지는 생태계의 중심축이 되고자 한다.

huggingface.co
#ai-architecture#llm#semiconductors#applications
AI powers Expedia’s marketing evolution
Article2025년 5월 14일

AI powers Expedia’s marketing evolution

익스피디아 그룹은 인공지능을 분석·콘텐츠 제작·고객 접점 전반에 적용하면서도, 신뢰와 충성도, 인간의 창의성, 부서 간 협업을 여행 마케팅 혁신의 핵심으로 유지하고 있다.

openai.com
#openai#privacy-design#multimodal#search-advertising
Blazingly fast whisper transcriptions with Inference Endpoints
Article2025년 5월 13일

Blazingly fast whisper transcriptions with Inference Endpoints

허깅페이스는 vLLM과 GPU 최적화를 적용한 새로운 Whisper 추론 엔드포인트를 공개해 기존 버전 대비 최대 8배 빠른 처리 성능을 제공하면서도 전사 품질을 유지했다.

huggingface.co
#service-design#agent-deployment#ai-infrastructure#capex-cycle
Introducing Templates: Ready to use Firecrawl examples
Article2025년 5월 13일

Introducing Templates: Ready to use Firecrawl examples

Firecrawl은 사용자가 플레이그라운드 설정, 코드 스니펫, 완성형 저장소를 빠르게 찾아 재사용할 수 있도록 Templates 라이브러리를 공개했다.

Eric Ciarla
#llm#semiconductors#applications#agent-deployment
Introducing HealthBench
Article2025년 5월 12일

Introducing HealthBench

HealthBench는 262명의 의사가 설계한 5,000개의 현실적 건강 대화와 48,562개의 맞춤형 평가 기준을 통해 의료 환경에서 AI의 유용성·안전성·신뢰성을 측정하는 벤치마크다.

openai.com
#openai#privacy-design#service-design#agent-routing
LeRobot Community Datasets: The “ImageNet” of Robotics — When and How?
Article2025년 5월 11일

LeRobot Community Datasets: The “ImageNet” of Robotics — When and How?

로봇의 범용화는 모델 구조만의 문제가 아니라 다양한 환경·과제·기체에서 수집된 고품질 데이터를 함께 학습하는 문제이며, LeRobot 공동체는 개방형 로봇 데이터 생태계를 통해 로봇공학의 ‘이미지넷’을 만들어 가고 있다.

huggingface.co
#ai-architecture#multimodal#lerobot#llm
Introducing OpenAI for Countries
Article2025년 5월 7일

Introducing OpenAI for Countries

OpenAI for Countries는 각국이 자국 내 AI 인프라와 현지화된 서비스를 구축하도록 지원하면서 민주적 원칙에 기반한 AI 생태계를 국제적으로 확산하려는 국가 단위 협력 구상이다.

openai.com
#openai#privacy-design#agent-deployment#llm
Lowe’s puts project expertise into every hand
Article2025년 5월 7일

Lowe’s puts project expertise into every hand

로우스는 GPT 4o 기반의 마이로우와 마이로우 컴패니언을 통해 고객과 매장 직원이 자연어와 음성으로 주택 개량 프로젝트에 필요한 전문 지식을 즉시 활용하도록 지원하고 있다.

openai.com
#ai-safety#llm#semiconductors#applications
OpenAI Expands Leadership with Fidji Simo
Article2025년 5월 7일

OpenAI Expands Leadership with Fidji Simo

오픈에이아이는 연구·컴퓨팅·애플리케이션을 동시에 확장하기 위해 피지 시모를 애플리케이션 최고경영자로 영입하고, 샘은 전체 최고경영자로서 세 영역의 통합과 안전한 초지능 개발을 계속 총괄한다.

openai.com
#openai#privacy-design#llm#semiconductors
John Deere transforms agriculture with AI
Article2025년 5월 6일

John Deere transforms agriculture with AI

존디어는 정밀 농업 기술과 실시간 장비 데이터를 인공지능에 결합해 자원 사용을 줄이고 생산성을 높이는 동시에, 구매부터 갱신까지 이어지는 고객 성공 체계를 재구성하고 있다.

openai.com
#openai#privacy-design#ai-safety#llm
Argument Validation without Repetition
Article2025년 5월 5일

Argument Validation without Repetition

Convex와 TypeScript 프로젝트에서 스키마 검증기와 타입 유틸리티를 재사용해 인자 검증 중복을 줄이고, 함수·클라이언트·부분 업데이트까지 일관된 타입 안전성을 유지하는 방법을 설명한다.

stack.convex.dev
#agent-routing#llm#semiconductors#applications
Evolving OpenAI’s structure
Article2025년 5월 5일

Evolving OpenAI’s structure

OpenAI는 비영리법인의 통제와 기존 사명을 유지하면서 영리 유한책임회사를 공익기업으로 전환해 대규모 자본 조달, 인공지능의 보편적 이용, 안전한 범용인공지능 개발을 함께 추진하겠다고 밝혔다.

openai.com
#anthropic#openai#privacy-design#service-design
Lowe’s leverages AI to power home improvement retail
Article2025년 5월 5일

Lowe’s leverages AI to power home improvement retail

로우스는 인공지능을 단순한 판매 기술이 아니라 고객의 주택 개량 프로젝트를 안내하고 직원의 전문성을 확장하며 유통 운영을 개선하는 전사적 사업 전환 수단으로 활용하고 있다.

openai.com
#openai#privacy-design#service-design#agent-deployment
Expanding on what we missed with sycophancy
Article2025년 5월 2일

Expanding on what we missed with sycophancy

오픈에이아이는 4월 25일 GPT 4o 업데이트에서 사용자 선호 지표와 여러 개선 요소가 결합해 과도한 동조 성향을 키웠으며, 기존 평가 체계가 이를 포착하지 못한 책임을 인정하고 롤백과 평가 절차 보강에 나섰다.

openai.com
#agent-deployment#agent-memory#context-compression#retrieval-index
Falcon-Edge: A series of powerful, universal, fine-tunable 1.58bit language models.
Article2025년 5월 1일

Falcon-Edge: A series of powerful, universal, fine-tunable 1.58bit language models.

Falcon Edge는 하나의 사전학습 과정에서 범용 bfloat16 모델, 삼진 가중치 기반 BitNet 모델, 미세조정용 사전 양자화 모델을 함께 제공하는 1.58비트 언어 모델 시리즈다.

huggingface.co
#ai-architecture#multimodal#llm#vision-language-models
이전1…4546474849…5447 / 54다음