AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 102 페이지
- 3
음악 스트리밍 서비스 Deezer, 일일 업로드의 50% 이상이 AI 생성이라고 발표
디저(Deelar)는 최근 일일 업로드되는 음악의 절반 이상이 AI로 생성된 곡이라고 밝혔으며, 이는 2025년 초 10% 수준에서 급격히 증가한 수치입니다. 이에 따라 디저는 스트리밍 사기 방지와 아티스트 권리 보호를 위해 일정 기간 재생되지 않거나 부정하게 생성된 AI 트랙을 삭제하는 조치를 취하기로 했습니다.
Music streamer Deezer says more than 50% of daily uploads are AI-generated↗techcrunch.com
- 4
Poolside, 라구나 S 2.1 출시: 크기 대비 10배 빠른 오픈 웨이트 코딩 모델
풀사이드는 정부 및 방위 기관에 코딩 모델을 공급해 온 이력을 바탕으로, 새로운 오픈 웨이트 모델인 라구나 S 2.1을 발표했습니다. 이 모델은 1180억 개의 파라미터를 가진 MoE 시스템으로, 토큰당 80억 개의 파라미터만 활성화하여 압도적인 연산 효율성을 자랑합니다.
Poolside drops Laguna S 2.1, an open-weight coding model that beats rivals 10x its size↗venturebeat.com
- 5
더 많은 GPU를 추가하는 것을 멈춰라: Weka의 새로운 스토리지 플랫폼, AI 모델의 사전 계산된 토큰을 100% 캐싱하여 로드 감소
Weka는 GPU 메모리 부족 문제를 해결하기 위해 사전 계산된 토큰을 저렴한 플래시 스토리지에 캐싱하는 새로운 플랫폼을 선보였습니다. 이는 긴 컨텍스트 창과 반복적인 연산을 처리할 때 발생하는 GPU 자원 낭비를 줄여 비용 효율적인 AI 운영을 가능하게 합니다.
Stop adding more GPUs: Weka's new storage platform reduces load by caching 100% of an AI model's pre-calculated tokens↗venturebeat.com
- 9
Google의 Gemini Flash 5.6 모델, 장기적인 엔지니어링 작업에서 AI 에이전트 토큰 비용 최대 65% 절감…3.5 Pro도 곧 출시
구글 딥마인드가 비용 효율성을 극대화한 Gemini 3.6 Flash, 3.5 Flash-Lite 등 세 가지 신규 AI 모델을 공개했습니다. 이 모델들은 대규모 환경에서 AI 에이전트를 더 저렴하고 빠르게 실행할 수 있도록 설계되었으며, 특정 작업에서 토큰 비용을 최대 65%까지 절감할 수 있습니다.
Google's Gemini Flash 5.6 model cuts AI agent token costs by up to 65% on long horizon engineering tasks —and 3.5 Pro is on the way↗venturebeat.com
- 10
Google의 Gemini 3.6 Flash 모델, 장기적인 엔지니어링 작업에서 AI 에이전트 토큰 비용 최대 65% 절감…3.5 Pro 버전도 출시 예정
구글 딥마인드가 AI 에이전트의 대규모 운용을 위해 저렴하고 빠른 제미니 3.6 플래시와 3.5 플래시-라이트 등 세 가지 신규 모델을 공개했습니다. 이번 모델들은 토큰 비용을 혁신적으로 낮추어 장기적인 엔지니어링 작업에서의 경제성을 확보하는 데 집중하고 있습니다.
Google's Gemini 3.6 Flash model cuts AI agent token costs by up to 65% on long horizon engineering tasks —and 3.5 Pro is on the way↗venturebeat.com
- 11
인과 모델은 인과 데이터를 필요로 한다 – Xaira의 X-Cell 모델, 신약 개발을 위한 접근법 (Bo Wang & Ci Chu, 최고 연구 책임자 & 최고 AI 과학자)
기존 RNA 발현 모델들은 유전자 간 상관관계는 잘 파악하지만, 특정 유전자를 조절했을 때의 인과적 결과를 예측하는 데 한계가 있었습니다. Xaira Therapeutics는 CRISPR 기술로 생성한 고품질 데이터셋 'X-Atlas'를 통해 세포 상태 변화를 정확히 예측할 수 있는 'X-Cell' 모델을 개발했습니다.
🔬Causal Models Need Causal Data - Xaira’s X-Cell model for Drug Discovery (Bo Wang & Ci Chu, Chief Discovery Officer & Chief AI Scientist)↗latent.space
- 15
평가는 새로운 PRD가 되었다, Expedia의 AI 최고 책임자가 VB Transform 2026에서 말한다
Expedia Group의 Javier Amatria는 AI 제품 개발 프로세스에서 'evals'가 기존 PRD의 역할을 대체하고 있다고 밝혔습니다. 그는 코딩 시작 전 단계부터 레드 팀 테스트와 보안 요구사항을 포함한 평가 지표를 설계 문서에 미리 통합하는 것이 필수적이라고 강조했습니다.
Evals are the new PRD, Expedia’s AI chief tells VB Transform 2026↗venturebeat.com
- 19
Grok 4.5 vs Claude Opus 4.8: 비용을 고려한 AI 에이전트 라우터 구축
AI 코딩 에이전트 개발 시 모든 작업을 고성능 모델에 의존하기보다, 저렴한 Grok 4.5를 기본으로 사용하고 복잡한 작업만 Claude Opus 4.8로 넘기는 라우터 구축이 비용 절감의 핵심입니다. 이 가이드는 두 모델의 성능 벤치마크와 토큰당 비용을 비교하여 효율적인 에스컬레이션 전략과 구현 시 주의사항을 제시합니다.
Grok 4.5 vs Claude Opus 4.8: Build a Cost-Aware AI Agent Router↗dev.to
- 20
JSON 축소기가 대형 정수를 은밀하게 손상시킬 수 있습니다—해결 방법은 다음과 같습니다.
많은 JSON 미니파이어가 데이터를 재구성하기 위해 `JSON.parse`와 `JSON.stringify`를 사용하는데, 이 과정에서 `Number.MAX_SAFE_INTEGER`를 초과하는 숫자의 정밀도가 손실될 수 있습니다. 이를 해결하려면 데이터의 구조적 파싱 대신 공백만 제거하는 문자 단위(character-level) 압축 방식을 채택해야 합니다.
Your JSON minifier might be silently corrupting large integers—here's the fix↗dev.to
- 22
이번 주 주목할 만한 소식: Inkling 개방형 가중치, GitHub Models 서비스 종료, Supabase Multigres
Thinking Machines Lab이 Apache 2.0 라이선스의 대규모 멀티모달 모델 Inkling을 공개했으며, GitHub Models 서비스는 Azure로의 전환을 위해 종료됩니다. 또한 Supabase의 Kubernetes 운영 도구 오픈소스화와 CodeQL의 프롬프트 인젝션 탐지 기능 추가 등 개발 보안 및 인프라 환경에 중요한 변화가 나타났습니다.
Notable this week: Inkling open weights, GitHub Models sunset, Supabase Multigres↗dev.to













