AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 203 페이지
- 3
넥스-엔2 프로를 테스트해봤습니다 - 코딩 벤치마크에서 GPT-5.5에 비견하는 무료 오픈 소스 모델
Nex AGI가 출시한 Nex-N2-Pro는 Qwen3.5 기반의 397B 파라미터 MoE 모델로, 단순 작업에는 빠른 응답을, 복잡한 코딩 작업에는 깊은 추론을 제공하는 '적응형 사고'를 특징으로 합니다. 이 모델은 Terminal-Bench 2.1에서 세계 상위 3위권의 성적을 기록하며 에이전틱 소프트웨어 엔지니어링과 도구 사용에 최적화되어 있습니다.
I Tested Nex-N2-Pro — A Free Open-Source Model That's Matching GPT-5.5 on Coding Benchmarks↗dev.to
- 11
OpenClaw 2026.6.1 업데이트 후 내 텔레그램 봇이 응답을 중단했습니다 - GPT-5의 문제가 아닌 디스크 용량 부족이었어요
OpenClaw 2026.6.1 업데이트 과정에서 발생한 AI 에이전트의 작동 중단 사례를 분석하여, 복잡한 모델 오류로 오해하기 쉬운 증상이 실제로는 디스크 용량 부족(ENESSPC)과 같은 단순 인프라 문제였음을 밝힙니다. 또한 업그레이드 시 발생하는 플러그인 및 데이터베이스 상태 불일치 문제를 해결하기 위한 체계적인 점검 프로세스를 제안합니다.
My Telegram bot stopped replying after OpenClaw 2026.6.1 — it was a full disk, not GPT-5↗dev.to
- 14
애플 WWDC AI 시연, 2억 5천만 달러 허위 광고 합의 이후 더욱 현실적으로 보이다
애플은 WWDC 2026을 통해 과거 '베이퍼웨어' 논란을 불식시키기 위해 실제 기기 작동을 강조하는 실감 나는 AI 시연 방식을 선보였습니다. 이번 발표는 새로운 Siri와 iOS 2점의 기능을 포함하며, 최신 기기에 국한되지 않고 기존 아이폰 15 프로 이상의 다양한 하드웨어 라인업에 적용될 예정입니다.
Apple’s WWDC AI demos looked more real after $250M false ad settlement↗techcrunch.com
- 17
MiMo-v2.5-Pro-UltraSpeed: 초당 1000 토큰 처리 속도를 가진 1T 모델
샤오미와 TileRT가 협력하여 개발한 MiMo-V2.5-Pro-UltraSpeed는 1T 규모 모델임에도 초당 1,000 토큰 이상의 디코딩 속도를 달성했습니다. 이는 FP4 양자화와 DFlash 기술을 통한 모델-시스템 공동 설계의 결과물로, 실시간 의사결정이 필요한 다양한 산업 분야에 혁신을 가져올 것으로 기대됩니다.
MiMo-v2.5-Pro-UltraSpeed: 1T model with 1000 tokens per second↗mimo.xiaomi.com
- 21
AI API 호출 시 3.75배나 더 많은 비용을 지불하고 있었는데, 이렇게 발견했습니다.
개발팀이 AI 기능을 빠르게 출시하는 과정에서 부적절한 모델 선택으로 인해 API 비용이 과다 청구되는 문제를 발견하고, 이를 해결하기 위해 GitHub Action을 통한 비용 분석 자동화 도구를 개발했습니다. 이 도구는 PR 단계에서 모델 오용, 중복 호출, 프롬프트 캐싱 기회 등을 사전에 감지하여 비용 효율적인 AI 아키텍처 구축을 돕습니다.
We Were Paying 3.75x More Than Necessary on Every AI API Call — Here's How We Found It↗dev.to

















