AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 181 페이지
- 11
10분 만에 구축한 중국 LLM용 저렴한 AI API 게이트웨이 방법
인디 개발자가 OpenAI의 높은 API 비용 문제를 해결하기 위해 One API 오픈소스를 활용하여 중국 LLM들을 통합 관리하는 게이트웨이를 구축한 사례를 소개합니다. 이 시스템은 다양한 중국 모델 제공업체의 서로 다른 API 형식을 OpenAI 표준 방식으로 변환하여 저렴하게 AI 서비스를 운영할 수 있게 돕습니다.
How I Built a Cost-Effective AI API Gateway for Chinese LLMs in 10 Minutes↗dev.to
- 12
키미 K2.7-코드: 1조 파라미터 오픈 웨이트 코더, MCP 우선 탑재
Moonshot AI가 1조 파라미터 규모의 MoE(Mixture-of-Experts) 코딩 모델인 Kimi K2.7-Code를 오픈 웨이트로 공개했습니다. 이 모델은 MCP(Model Context Protocol) 기반의 도구 사용에 특화되어 에이전트 구축에 유리하며, 매우 저렴한 API 비용을 제공합니다. 다만, 벤치마크 결과가 제조사 자체 발표라는 점은 주의 깊게 살펴봐야 합니다.
Kimi K2.7-Code: 1T-Param Open-Weight Coder Goes MCP-First↗dev.to
- 13
클로드 토큰 낭비하지 마세요: 코드를 먼저 탐색할 수 있는 무료, 로컬, 안전한 방법
이 기사는 클라우드 LLM에 코드를 직접 입력하는 대신, 로컬 환경에서 Ollami를 통해 코드베이스를 인덱싱하고 필요한 정보만 추출하여 비용을 절감하는 'talk-to-your-code' 도구를 소개합니다. 하이브리드 검색과 구조화된 생성 방식을 통해 정확도를 높이고 토큰 낭비를 최소화하는 구체적인 엔지니어링 방법론을 다룹니다.
Don’t Burn Claude Tokens: A Free, Local, Secure Way to Explore Your Code First↗dev.to
- 17
Qwen 3:0.6B와 같은 로컬 LLM을 파인튜닝하여 질문 분류하는 데 좋은 결과 얻다
가계 관리용 챗봇 프로젝트에서 질문을 사전 분류하여 벡터 검색 범위를 좁히는 '메타데이터 인식형(Metadata-aware) RAG'를 구현했습니다. 기본 모델의 낮은 분류 정확도를 극복하기 위해 Unsloth 프레임워크를 활용해 0.6B 파라미터의 초소형 모델을 특정 도메인에 맞춰 파인튜닝하는 과정을 다룹니다.
Good results fine tuning a local LLM like Qwen 3:0.6B to categorize questions↗teachmecoolstuff.com
- 23
클로드 지금 다운됐을까? 불완전한 응답 함정 (2026 라이브 상태, 해결책 및 대체 방안)
2026년 6월 21일, Anthropic의 Claude 서비스에서 응답이 중간에 끊기는 대규모 장애가 발생하여 수천 명의 개발자가 혼란을 겪었습니다. 특히 에러 없이 데이터만 손실되는 '불완전 응답 함정' 현상으로 인해 개발자들이 자사 시스템의 오류로 오인해 막대한 디버깅 비용을 소모하는 문제가 부각되었습니다.
Is Claude Down Right Now? The Incomplete Response Trap (2026 Live Status, Fixes & Fallbacks)↗dev.to
















