AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 121 페이지
- 4
가장 저렴한 실행 가능한 모델로 요청 라우팅하기: 비용 최적화 가이드
LLM 비용은 토큰 사용량에 따라 결정되며 모델 간 가격 편차가 매우 크기 때문에, 모든 요청을 고가의 프리미엄 모델로 처리하는 것은 비효율적입니다. Bifrost와 같은 AI 게이트웨이를 활용한 동적 라우팅은 작업 난이도에 맞춰 최적의 모델을 연결함으로써 비용 절감과 서비스 품질 유지, 시스템 회복탄력성을 동시에 달성할 수 있게 합니다.
Routing Requests to the Cheapest Capable Model: A Cost-Optimization Guide↗dev.to
- 7
복잡한 비즈니스 워크플로우, 맞춤형 AI 시스템이 готовый 솔루션보다 자주 뛰어난 이유
범용 AI 도구는 일반적인 업무에는 유용하지만, 기업 고유의 데이터와 복잡한 워크플로우를 포함하는 핵심적인 30%의 문제를 해결하기에는 한계가 있습니다. 따라서 비즈니스 병목 현상을 먼저 정의하고, 기존 모델과 내부 시스템을 결합하여 특정 프로세스에 최적화된 맞춤형 AI 시스템을 구축하는 전략이 필요합니다.
Why Custom AI Systems Often Beat Off-the-Shelf Tools for Complex Business Workflows↗dev.to
- 13
리더보드에서 얻은 교훈: 5,000명 이상의 Kaggle 참가자들이 AI 추론 개선에 대해 알려준 것들
NVIDIA Nemotron 모델 추론 경진대회는 5,000명 이상의 참가자가 참여하여 AI의 논리적 사고 능력을 개선하는 실전적인 방법론을 제시했습니다. 상위 솔루션들은 단순한 데이터 증설보다 검증 가능한 사고 과정(CoT) 구축, 토큰 예산에 맞춘 추론 압축, 그리고 고품질 학습 데이터 생성을 위한 워크플로우 엔지니어링에 집중했습니다.
Lessons From the Leaderboard: What 5,000+ Kagglers Taught Us About Improving AI Reasoning↗developer.nvidia.com
- 16
Amazon Nova Act을 활용한 UX 테스트 확장: 사용자 흐름 분석의 새로운 접근 방식
Amazon Nova Act는 스크린샷을 직접 분석하는 멀티모달 모델로, 기존의 코드 기반 자동화 도구와 달리 UI 변경에도 깨지지 않는 지능형 UX 테스트를 가능하게 합니다. AWS 기반 아키텍처를 통해 문서로부터 테스트 시나리오를 생성하고 대규모 병렬 실행 및 사용자 경험 분석까지 자동화하는 통합 솔루션을 제안합니다.
Scaling UX testing with Amazon Nova Act: A new approach to user flow analysis↗aws.amazon.com
- 17
Flo Health에서 Amazon Bedrock으로 의료 콘텐츠 검토 확장하기 - 2부
Flo Health은 의료 콘텐츠의 정확성을 유지하면서도 생산성을 높이기 위해 Amazon Bedrock 기반의 AI 검토 시스템을 구축했습니다. 이 시스템은 내부 가이드라인과 외부 신뢰 소스를 활용한 3단계 검증 체계를 통해 리뷰 시간을 60% 줄이고 콘텐츠 처리량을 3배로 확대하는 성과를 거두었습니다.
Scaling medical content review at Flo Health with Amazon Bedrock – Part 2↗aws.amazon.com
- 18
메타의 아담 모세리, AI 토큰 예산이 엔지니어 당 곧 제한될 수 있다고 말하다
메타의 아담 모세리는 엔지니어의 AI 토큰 소모 비용이 곧 그들의 인건비와 맞먹는 수준에 이를 수 있어, 향후 기업들이 토큰 예산을 제한할 가능성이 높다고 전망했습니다. 이는 메타뿐만 아니라 우버, 마이크로소프트 등 글로벌 빅테크 기업들도 급증하는 AI 비용 관리를 위해 실험적인 접근을 축소하거나 도구를 통합하는 추세임을 보여줍니다.
Meta’s Adam Mosseri says AI token budgets could soon be capped per engineer↗techcrunch.com
- 19
실제 음성 AI의 인간적 품질 측정, Real World VoiceEQ 출시
HumeAI는 단순한 정확도나 지연 시간을 넘어 음성 AI의 인간적 품질을 측정하기 위해 40개 이상의 모델을 대상으로 한 'Real World VoiceEQ' 벤치마크를 공개했습니다. 이 연구는 현재의 음성 모델들이 말하기 능력에 비해 청취 및 감정 이해 능력이 부족하며, 특정 기능에 특화된 모델들이 분화되고 있음을 보여줍니다.
Introducing Real World VoiceEQ: Measuring the human quality of voice AI↗huggingface.co
- 22
클로드의 내부 작동 원리, 그리고 세계 모델의 미래
Anthropic은 클로드 모델의 내부 사고 메커니즘을 들여다볼 수 있는 새로운 창을 발견했다고 발표하며, 향후 AI가 물리적 세계를 이해하기 위해 필요한 '세계 모델'의 중요성을 조명했습니다. 이와 함께 데이터 센터 규제, 엔비디아의 대중국 칩 수출 통제, 스마트폰 시장 위축 등 글로벌 테크 산업의 주요 변동 사항들을 다루고 있습니다.
The Download: Claude’s inner workings, and the future of world models↗technologyreview.com














