AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 201 페이지
- 2
앤스로픽 클로드 페이블 5 - 논란이 될 수 있는 용어를 포함한 마이토스 버전, 하지만 안전하게
앤스로픽이 코딩 및 복잡한 작업 성능이 대폭 향상된 Mythos급 모델인 '클로드 페이블 5'를 출시했습니다. 하지만 모든 트래픽에 대한 30일 데이터 보관과 경쟁 LLM 개발을 방해하기 위한 비가시적 제재(RSI suppression)라는 논란의 여지가 있는 정책이 포함되었습니다.
[AINews] Anthropic Claude Fable 5 — Mythos but Safe, with Controversial Terms↗latent.space
- 3
Claude Fable 5, @sejournal 및 @martinibuster에 따르면 "차세대 수준"으로 느껴져
Anthropic이 새로운 플래그십 모델 Claude Fable 5를 공개하며 코딩, 연구, 시각적 분석 분야의 비약적인 발전을 발표했습니다. 특히 대규모 코드베이스 마이그레이션을 단 하루 만에 완료하는 등 자율적인 소프트웨어 엔지니어링 능력을 입증하며 지식 노동의 효율성을 극대화할 것으로 기대됩니다.
Claude Fable 5 “Feels Next Level” via @sejournal, @martinibuster↗searchenginejournal.com
- 4
Show HN: 리옹가프 스태빌리티 이론을 적용하여 LLM 에이전트의 나선형 현상 감지하기
state-harness는 LLM 에이전트 실행 중 발생하는 컨텍스트 누적, 재시도 폭풍 등의 비정상적인 패턴을 실시간으로 감지하는 런타임 안전 장치입니다. 단순한 예산 제한을 넘어 실패 원인을 분류하고 구체적인 최적화 방안을 제안함으로써 에이전트 운영의 가시성과 비용 효율성을 동시에 확보합니다.
Show HN: I applied Lyapunov stability theory to detect when LLM agents spiral↗github.com
- 6
Show HN: KnowledgeMCP – 모든 문서를 MCP 엔드포인트로 변환하세요 (쿼리 시 0 LLM)
KnowledgeMCP는 파편화된 문서를 Claude나 Cursor 같은 AI 에이전트가 즉시 읽고 검색할 수 있는 MCP(Model Context Protocol) 엔드포인트로 만들어줍니다. 특히 LLM 호출 없이 로컬 임베딩과 OpenSearch를 활용하여 쿼리 비용을 제로화하고 지연 시간을 최소화한 것이 핵심입니다.
Show HN: KnowledgeMCP – Turn any docs into an MCP endpoint (0 LLM at query time)↗github.com
- 12
CI 환경에서 LLM 앱 보호: 프롬프트 회귀 테스트 및 에이전트 추적 정책과 llm-canary
LLM 기반 앱의 프롬프트 변경이나 RAG 파이프라인 수정이 가져오는 '침묵의 회귀(Silent Regression)' 문제를 해결하기 위한 자동화된 테스트 도구가 공개되었습니다. 이 도구는 단순 답변 검증을 넘어 에이전트의 행동 정책 준수 여부와 비용 드리프트를 추적하며, 보안을 위해 자체 호스팅 가능한 평가 서버 기능을 제공합니다.
Gate your LLM app in CI: prompt regression testing + agent trace policies with llm-canary↗dev.to
- 17
LLM 기반의 통일되고 제어 가능하며 충실한 텍스트-CAD 생성 방법
기존의 텍스트 기반 CAD 생성 방식이 생성과 편집을 별개의 작업으로 취급했던 한계를 극복하기 위해, PR-CAD는 점진적 정제(Progressive Refinement) 방식을 제안합니다. 이 프레임워크는 LLM 기반의 강화 학습을 통해 설계 의도 파악부터 매개로 추정, 정밀 편집까지 단일 에이전트로 수행하며 모델링 효율성을 극대화합니다.
Unified Controllable and Faithful Text-to-CAD Generation with LLMs↗arxiv.org

















