AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 107 페이지
- 5
발음하기 어려운 기호들의 나열, 키런 헤브든(Four Tet)의 놀라운 사이드 프로젝트
아티스트 키런 헤브든이 특수 문자로 구성된 난해한 브랜딩의 앨범 'Wingdings'를 정식 출시했습니다. 이 프로젝트는 검색 엔진 최적화(SEO)를 포기한 극단적인 실험성을 보여주지만, 이미 수백만 회의 재생수를 기록하며 음악적 완성도를 입증하고 있습니다.
This unpronounceable series of glyphs is an incredible side project from Kieran Hebden (aka Four Tet)↗theverge.com
- 6
뮤온에서 그래디언트 클리핑까지: QK 안정성에 대한 몇 가지 생각
뮤온(Muon) 옵티마이저는 매개변수 공간이 아닌 함수 공간에서의 변화량을 제한하여 업데이트를 수행하는 혁신적인 방식을 제안합니다. 하지만 트랜스포머의 Q와 K 행렬에 이를 직접 적용할 경우, 어텐션 메커니즘의 쌍선형(Bilinear) 특성으로 인해 학습이 붕괴되는 문제가 발생하며 이에 대한 이론적 해결책 모색이 필요함을 다룹니다.
From Muon to Gradient Clipping: Some Thoughts on QK Stability↗mastergodzilla.github.io
- 8
RAG 대규모 최적화: 청킹, 검색, 그리고 지연 시간 40% 단축을 이룬 베이지안 검색
본 기사는 프로덕션 환경의 RAG 성능 저하 문제를 해결하기 위해 문서 특성에 맞춘 다양한 청킹 전략과 BM25 및 벡터 검색을 결합한 하이브리드 리트리버 구축 방법을 다룹니다. 또한 쿼리 확장 및 분해를 통해 사용자 질문의 의도를 정교하게 파악하여 검색 정확도와 시스템 효율성을 동시에 높이는 구체적인 아키텍처를 제안합니다.
Optimizing RAG at Scale: Chunking, Retrieval, and the Bayesian Search That Cut Latency 40%↗dev.to
- 20
오픈 웨이트는 오픈 소스가 아니다: 완전한 개방형 기반 모델 에테르-7B-5Attn (Apache-2.0 라이선스)
VIDRAFT는 학습 데이터, 코드, 하이퍼파라미터 등 전체 제조 과정을 Apache-2.0 라이선스로 공개한 '완전 개방형' 모델 Aether-7B-5Attn을 발표했습니다. 이 모델은 라틴 스퀘어 구조를 활용한 이종 어텐션 메커니즘을 도입했으며, 한국어와 영어를 포함한 고품질 데이터셋으로 학습되었습니다.
Open Weights Aren't Open Source: Aether-7B-5Attn, a From-Scratch Fully-Open Foundation Model (Apache-2.0)↗dev.to
- 21
특권 CI 토큰 재사용 방법 두 가지 (내 규칙은 하나만 잡아냈다)
GitHub Actions의 workflow_do 트리거가 가진 토큰 재사용 위험성을 탐지하는 과정에서, 기존 규칙이 특정 조건(아티팩트 재사용과 권한 제한 부재)이 겹칠 때만 작동하여 보안 구멍을 만들었음을 발견했습니다. 이를 해결하기 위해 공격 경로를 독립적으로 감시하는 두 개의 별도 규칙으로 분리하여 탐지 정밀도를 높였습니다.
Two ways to reuse a privileged CI token (and my rule only caught one)↗dev.to


















