AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 209 페이지
- 0
알리바바 & 앤트그룹 룽수이트 GenAI 관측 가능성 의미 체계 명세: 통합 데이터 언어에서 대규모 구현까지
알리바바의 LoongSuite는 OpenTelemetry를 확장하여 AI 에이전트, 토큰, 프롬프트 등 GenAI 핵심 요소에 대한 표준화된 관측 가능성(Observability) 규격을 제안합니다. 이를 통해 파편화된 AI 데이터를 통합하여 시스템 트러블슈팅부터 비용 관리, 보안 감사까지 일관된 방식으로 수행할 수 있는 기반을 마련합니다.
Alibaba & Ant Group LoongSuite GenAI Observability Semantics Specification: From Unified Data Language to Large-scale Implementation↗dev.to
- 9
화웨이, KV 캐시 양자화를 위한 네이티브 vLLM 백엔드 KVarN 공개
화웨이가 개발한 KVarN은 vLLM에 즉시 적용 가능한 KV 캐시 양자화 기술로, 기존 방식과 달리 정확도 저하 없이 캐시 용량을 3~5배 확장하고 처리량을 높입니다. 하다마르 회전과 분산 정기화를 통해 아웃라이어를 제어함으로써, 긴 컨텍스트와 높은 동시 접속이 필요한 대규모 언어 모델(LLM) 서빙의 효율성을 획기적으로 개선합니다.
KVarN: Native vLLM backend for KV-cache quantization by Huawei↗github.com
- 10
AI가 스스로를 구축할 때: 재귀적 자기 개선을 향한 우리의 진전
Anthropic은 AI 에이전트의 발전으로 엔지니어의 코드 배포량이 8배 증가하는 등 AI가 AI 개발 속도를 비약적으로 높이고 있다고 밝혔습니다. AI가 스스로 모델을 설계하고 훈련하는 '재기적 자기 개선' 단계로의 진입 가능성을 제시하며, 이는 기술적 도약과 동시에 통제 상실이라는 위험을 동시에 내포하고 있습니다.
When AI Builds Itself: Our progress toward recursive self-improvement↗anthropic.com
- 11
이 LLM들은 러시아 선전선동에 가장 잘 저항한다
에스토니아 언어 연구소(ELI)는 LLM이 러시아의 전략적 서사에 얼마나 잘 대응하는지 측정하는 '선전선동 저항(Propaganda Resistance)' 벤치마크를 공개했습니다. 테스트 결과 Anthropic의 Claude 모델이 가장 우수한 성능을 보였으며, 반면 Google의 Gemini 모델은 악의적인 프롬프트와 러시아어 질문에 취약한 모습을 보였습니다.
These LLMs are the best at resisting Russian propaganda↗arstechnica.com
- 12
알림 해킹을 통한 간접 프롬프트 주입, Android의 Google Gemini 공격
SafeBreach 연구원은 WhatsApp, Slack 등 다양한 앱의 알림을 통해 Google Gemini의 Android Utilities 기능을 공격하는 간접 프롬프트 주입 기법을 공개했습니다. 공격자는 다국어 난독화와 숨겨진 링크를 이용해 사용자가 인지하지 못한 상태에서 민감한 기기 동작을 실행하도록 유도할 수 있습니다.
Indirect Prompt Injection via Notifications Hijacks Google Gemini on Android↗dev.to
- 17
구글의 신규 AI 모델, Gemma 4 12B: 최소한의 하드웨어 요구사항으로 온디바이스 AI 처리 지원
구글이 발표한 Gemma 4 12B는 16GB RAM 수준의 일반 노트북에서도 원활하게 작동하도록 설계된 경량화된 멀티모달 모델입니다. Apache 2.0 라이선스를 통해 누구나 상업적으로 이용 가능하며, 이는 클라우드 중심의 AI 패러다임을 온디바이스 중심으로 전환하는 계기가 될 것입니다.
Google's New AI Model, Gemma 4 12B, Enables On-Device Processing with Minimal Hardware Requirements↗dev.to
- 19
LLM-CLI-Gateway 2.0.0: 조용하지만 중요한 공급망 업데이트
llm-cli-gateway 2.0.0은 기존의 better-sqlite3 의존성을 제거하고 Node.js 내장 node:sqlite를 도입하여 설치 과정에서의 공급망 공격 경로를 차단했습니다. 이를 위해 Node.js 24.4.0 이상의 최신 버전을 요구하며, 데이터베이스 엔진 교체 시에도 기존 데이터의 무결성을 보장하는 강력한 검증 과정을 거쳤습니다.
llm-cli-gateway 2.0.0: the quiet supply-chain release that matters↗dev.to
- 22
중국의 AI 가격 전쟁, 이 주 99% 할인 돌파… 글로벌 인디 해커들이 활용해야 할 방법 (무료 토큰 포함)
텐센트와 샤오미 등 중국 LLM 제공업체들이 모델 가격을 최대 99%까지 인하하며 글로벌 AI 가격 전쟁이 격화되고 있습니다. 이에 따라 중국 모델의 높은 접근 장벽을 해결하고 OpenAI 호환 API로 통합 제공하는 PandasRouter와 같은 서비스가 주목받고 있습니다.
🚀 With China’s AI price war hitting 99% off this week, here is how global Indie Hackers can exploit it (Free Tokens Inside)↗indiehackers.com















