Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#ibm-research
Tag5건Article 5

#ibm-research

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#agent-failure-modes공동문서 2 · 연관도 63%#agent-architecture공동문서 1 · 연관도 45%#agent-logic공동문서 1 · 연관도 45%#api-chaining공동문서 1 · 연관도 45%#app-insights공동문서 1 · 연관도 45%#appworld공동문서 1 · 연관도 45%#asset-operations공동문서 1 · 연관도 45%#assetopsbench공동문서 1 · 연관도 45%#assetopsbench-live공동문서 1 · 연관도 45%#aster공동문서 1 · 연관도 45%
Beyond LLMs: Why Scalable Enterprise AI Adoption Depends on Agent Logic
Article2026년 6월 1일

Beyond LLMs: Why Scalable Enterprise AI Adoption Depends on Agent Logic

이 글은 기업 AI 확산의 핵심이 더 큰 LLM 자체가 아니라, LLM의 탐색 범위를 줄이고 업무 흐름 안에서 정확하게 작동하도록 이끄는 ‘에이전트 로직’에 있다고 주장한다.

Hugging Face
#aster#app-insights#hugging-face#ibm-research
IBM and UC Berkeley Diagnose Why Enterprise Agents Fail Using IT-Bench and MAST
Article2026년 4월 21일

IBM and UC Berkeley Diagnose Why Enterprise Agents Fail Using IT-Bench and MAST

IBM Research와 UC Berkeley는 ITBench 실행 추적에 MAST 실패 분류법을 적용해 엔터프라이즈 IT 자동화 에이전트가 단순히 실패했는지가 아니라 어디서, 왜, 어떤 방식으로 무너지는지를 진단했다.

huggingface.co
#itbench#ibm-research#uc-berkeley#gemini-3-flash
Inside VAKRA: Reasoning, Tool Use, and Failure Modes of Agents
Article2026년 3월 31일

Inside VAKRA: Reasoning, Tool Use, and Failure Modes of Agents

VAKRA는 기업형 환경에서 에이전트가 API, 문서, 대화 맥락, 정책 제약을 넘나들며 다단계 추론과 도구 사용을 실제 실행 궤적으로 수행할 수 있는지 평가하는 실행 중심 벤치마크다.

huggingface.co
#vakra#hugging-face#ibm-research#rest-bird
CUGA on Hugging Face: Democratizing Configurable AI Agents
Article2025년 12월 17일

CUGA on Hugging Face: Democratizing Configurable AI Agents

CUGA는 복잡한 웹·API 작업을 수행하는 오픈소스 구성형 범용 AI 에이전트로, Hugging Face Spaces와 Langflow 통합을 통해 실험과 배포 장벽을 낮추려는 프로젝트입니다.

huggingface.co
#appworld#langflow#hugging-face#ibm-research
AssetOpsBench: Bridging the Gap Between AI Agent Benchmarks and Industrial Reality
Article2025년 6월 4일

AssetOpsBench: Bridging the Gap Between AI Agent Benchmarks and Industrial Reality

AssetOpsBench는 산업 설비 운영 환경에서 AI 에이전트가 실제로 안전하고 신뢰할 수 있게 작동하는지를 다중 에이전트 조정, 근거 기반 판단, 실패 인식, 작업 실행 가능성 중심으로 평가하는 벤치마크입니다.

huggingface.co
#assetopsbench#trajfm#assetopsbench-live#ibm-research