AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 265 페이지
- 2
ERNIE-Image: 포스터, 만화, 텍스트 풍부한 시각 콘텐츠에 최적화된 텍스트-이미지 모델
바이두가 공개한 ERNIE-Image는 단순한 실사 이미지 생성을 넘어, 텍스트 렌더링, 레이아웃 구조, 다중 패널 구성 등 '사용 가능한 시각 콘텐츠' 생성에 최적화된 모델입니다. Diffusion Transformer(DiT) 아키텍처를 기반으로 포스터, 만화, 인포그래픽 등 구조적 정보가 중요한 디자인 영역에서 압도적인 성능을 보여줍니다.
ERNIE-Image: A Text-to-Image Model Built for Posters, Comics, and Text-Rich Visual Content↗dev.to
- 4
4,584개의 MCP 서버 분석 결과, 평균 신뢰 점수는 100점 만점에 53.9점
4,584개의 MCP(Model Context Protocol) 서버를 분석한 결과, 평균 신뢰 점수가 100점 만점에 53.9점에 불과한 것으로 나타났습니다. 이는 현재 MCP 생태계의 많은 서버가 실험적 단계에 머물러 있으며, AI 에이전트 개발 시 도구의 실제 런타임 동작과 안정성을 검증하는 것이 필수적임을 시사합니다.
We Analyzed 4,584 MCP Servers — The Average Trust Score Is 53.9 Out of 100↗dev.to
- 5
임베딩 공간의 드리프트를 감지하는 오픈 소스 Python 툴을 직접 만들었습니다
임베딩 공간의 변화를 직접 감지하여 모델 성능 저하가 발생하기 전에 조기 경보를 제공하는 오픈 소스 Python 도구 'drift-lens-monitor'가 출시되었습니다. 이 도구는 통계적 거리(FED, MMD)와 위상수학적 분석(Persistent Homology)을 활용해 임베딩 데이터의 구조적 변화를 정밀하게 추적합니다.
I built an open-source Python tool to detect drift in embedding spaces↗dev.to
- 7
13시간 동안 제한 없는 Firebase 브라우저 키로 Gemini API에 접속하며 54,000유로 폭증
Firebase 브라우저 키의 API 권한 제한 미비로 인해 단 13시간 만에 54,000유로(약 8,000만 원)의 Gemini API 비용이 청구된 사건이 발생했습니다. 구글 클라우드는 해당 사용을 프로젝트 내에서 발생한 '유효한 사용'으로 간주하여 비용 환불 요청을 거부했습니다.
€54k spike in 13h from unrestricted Firebase browser key accessing Gemini APIs↗discuss.ai.google.dev
- 9
Show HN: MacMind – 1989년 매킨토시에서 HyperCard로 구현된 트랜스포머 뉴럴 네트워크
1987년 출시된 HyperTalk 언어를 사용해 1989년형 매킨토시에서 구현된 초소형 트랜스포머 모델 'MacMind'를 소개합니다. 이 프로젝트는 현대 GPT-4와 같은 거대 언어 모델의 핵심 원리인 어텐션과 역전파가 규모의 차이일 뿐, 근본적으로 동일한 수학적 메커니즘임을 증명합니다.
Show HN: MacMind – A transformer neural network in HyperCard on a 1989 Macintosh↗github.com
- 11
내 노트북의 Qwen3.6-35B-A3B가 Claude Opus 4.7보다 더 나은 갈매기를 그려줬다
로컬 환경에서 실행되는 경량화된 Qwen 3.6-35B-A3B 모델이 Anthropic의 최신 대형 모델인 Claude Opus 4.7보다 특정 SVG 생성 작업(자전거 타는 갈매기 그리기)에서 더 뛰어난 성능을 보였습니다. 이는 거대 모델의 범용적 성능과 특정 태스크에서의 정밀도 사이의 괴리를 보여주는 흥미로운 사례입니다.
Qwen3.6-35B-A3B on my laptop drew me a better pelican than Claude Opus 4.7↗simonwillison.net
- 16
모델 컨텍스트 프로토콜로 구축하기: MCP 통합을 위한 개발자 가이드
Model Context Protocol(MCP)은 AI 에이전트와 외부 도구, 데이터베이스, API를 연결하는 표준화된 인터페이스로, 개별 서비스마다 별도의 통합 코드를 작성할 필요 없는 '범용 어댑터' 역할을 합니다. 이를 통해 개발자는 복잡한 통합 과정 없이 표준화된 방식으로 AI 에이전트의 기능을 확장하고 관리할 수 있습니다.
Building with Model Context Protocol: A Developer's Guide to MCP Integration↗dev.to
- 20
Gemini, Google 포토를 분석하여 개인 맞춤형 AI 이미지를 생성할 수 있게 됐습니다.
구글이 Gemini에 '개인 맞춤형 지능(Personal Intelligence)' 기능을 도입하여 구글 포토와 연동하기 시작했습니다. 이를 통해 사용자는 별도의 복잡한 프롬프트 입력 없이도 자신의 사진 속 인물이나 반려동물을 활용해 개인화된 AI 이미지를 생성할 수 있습니다.
Gemini can now create personalized AI images by digging around in Google Photos↗arstechnica.com






![TigerBeetle: 1조 트랜잭션 [영상]](https://startupschool.cc/og/tigerbeetle-a-trillion-transactions-video-b219af.jpg)







