총 2533건 중 1585-1608건
Spotify Engineering은 LLM 평가를 A/B 테스트의 대체재가 아니라, 실험 전 후보를 걸러내고 실험 후 판단 기준을 보정하는 ‘평가 퍼널’로 사용해야 한다고 설명한다.
호주 노인요양기관 Regis는 RegiCare Assist로 방대한 24시간 보고서와 인수인계 기록을 요약해 임상관리자가 서류보다 입소자 돌봄에 더 많은 시간을 쓰도록 하고 있습니다.
Browse.sh는 브라우저 에이전트가 매번 같은 웹사이트 탐색을 다시 학습하지 않도록, 검증된 웹 작업 절차를 재사용 가능한 “브라우저 스킬”로 축적하려는 오픈 카탈로그다.
Hermes에 xAI의 Grok 구독 기반 x search가 연결되면서, X를 실시간 리서치 소스로 활용하는 개인 분석가 워크플로가 훨씬 강해졌다는 주장이다.
허깅페이스 커널 허브는 파이썬·파이토치·쿠다 환경에 맞는 사전 최적화 연산 커널을 허브에서 내려받아, 복잡한 로컬 빌드 없이 모델의 특정 연산에 적용하도록 돕는 체계다.
OpenAI와 Dell Technologies는 Codex를 기업의 핵심 데이터와 시스템이 있는 하이브리드 및 온프레미스 환경에 더 가깝게 배포할 수 있도록 협력한다.
Cloudflare는 Project Glasswing에서 Mythos Preview를 자사 저장소 50여 개에 적용하며, 보안 특화 LLM이 취약점 발견을 넘어 exploit chain과 실행 가능한 증명까지 만들 수 있지만 대규모 활용에는 정교한 harness와 검증 구조가 필요하다고 설명한다.
MIT Sloan은 기업들이 AI를 ‘도입해야 할 기술’로만 보고 명확한 사업 문제, 조직 변화, 가치 실현 경로를 함께 설계하지 않기 때문에 대규모 성과를 내지 못한다고 지적한다.
이 글은 AI 시대의 핵심 경쟁력이 단순한 도구 사용이 아니라 AI를 이해하고 선택하며 현실 문제 해결과 가치 설계에 연결하는 능력이라고 설명한다.
OpenAI와 몰타 정부는 시민이 인공지능 활용 교육을 이수하면 ChatGPT Plus를 1년간 무료로 이용할 수 있도록 하는 세계 최초의 국가 단위 협력 프로그램을 추진한다.
이 글은 Stagehand의 자연어 브라우저 제어와 Convex의 실행별 임시 백엔드를 결합해, 선택자 중심 E2E 테스트의 취약성을 줄이고 실제 사용자 의도에 가까운 테스트를 구성한 경험을 정리한다.
제공된 원문은 AI Andrew의 설계 원칙과 한계, 미국 정부의 첨단 AI 모델 사전 평가 전환, OpenAI의 실시간 음성 모델 업데이트를 중심으로 AI 제품화와 안전성 검증의 긴장을 다룬다.
Databricks는 복잡한 기업 문서 작업 벤치마크인 OfficeQA Pro에서 GPT 5.5가 새 최고 성능을 기록하자, 이를 고객용 엔터프라이즈 에이전트 워크플로에 제공하기 시작했다.
Hermes Agent는 단순 질의응답 도구가 아니라, 메모리·스킬·툴·배포 환경을 결합해 마케팅 워크플로를 반복 실행하고 점진적으로 자동화하는 오픈소스 에이전트 운영 프레임워크라는 주장이다.
ZeroGPU의 짧게 생성되는 GPU 프로세스에서는 실행 시점 컴파일보다 모델을 한 번 미리 컴파일하고 즉시 다시 불러오는 PyTorch 사전 컴파일이 적합하며, 생성 모델의 추론 속도를 최대 1.8배까지 높일 수 있다.
OpenAI는 미국 Pro 사용자를 대상으로 ChatGPT 안에서 금융 계좌를 연결해 지출, 투자, 구독, 목표 계획을 더 개인화해 이해하고 관리할 수 있는 개인 금융 경험을 출시한다고 밝혔다.
Every는 전 직원에게 개인 AI 에이전트를 붙이는 방식이 실제 업무에서는 기대보다 많은 관리 부담과 혼선을 만들었고, Plus One을 팀 단위의 명확한 역할형 에이전트로 재설계하기로 했다.
OpenAI의 GPT OSS는 Apache 2.0으로 공개된 20B·120B 오픈 웨이트 추론 모델군으로, Hugging Face 생태계에서 API·로컬 추론·GPU별 최적화를 통해 폭넓게 활용할 수 있도록 소개된다.
이 글은 에이전트형 프로그래밍의 부상 속에서 레거시 현대화, 금융권 규제 복잡성, 주니어 개발자 교육, 인간의 학습, 도구 설계, AI의 위험을 둘러싼 여러 단상과 논점을 엮어 정리한다.
Anthropic은 게이츠 재단과 향후 4년간 2억 달러 규모의 보조금, Claude 사용 크레딧, 기술 지원을 투입해 글로벌 보건, 생명과학, 교육, 경제적 이동성 분야에서 AI 활용 프로그램을 추진한다고 발표했다.
이 글은 파운데이션 모델의 확장이 사전학습 중심에서 사후학습·추론 시점 연산까지 넓어지면서, AWS 위에서 가속 컴퓨트·저지연 네트워크·분산 스토리지·오픈소스 운영 스택이 어떻게 함께 설계되어야 하는지 설명한다.
Sea는 Codex를 전사 개발 조직에 도입하며 AI 코딩 도구를 단순 생산성 향상이 아니라 복잡한 대규모 시스템을 더 빠르고 견고하게 운영하기 위한 조직적 전환으로 보고 있다.
코스타리카 유제품 협동조합 도스 피노스는 Microsoft Copilot 기반 AI 에이전트를 포장 검수, 보고 자동화, 법무·리스크·고객 업무 등에 도입해 직원의 반복 업무를 줄이고 운영 효율과 품질 관리 역량을 높이고 있다.
LangChain은 Interrupt에서 LangSmith Engine, SmithDB, Managed Deep Agents, Sandboxes GA, Context Hub, LLM Gateway, Fleet 기능 확장, Deep Agents 0.6 등 에이전트 개발·운영 전 주기를 가속하는 제품과 기능을 발표했다.