AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 42 페이지
- 0
Opik vs Langfuse: 두 오픈소스 LLM 관측 도구의 합치점과 차이점
LLM 관측 도구인 Opik과 Langfuse는 프롬프트 템플릿 및 플레이그라운드 트레이싱 기능에서는 공통적인 한계를 보이지만, 버전 관리의 디테일과 핵심 기능(가드레일 vs 알림)에서 큰 차이를 나타냅니다. 특히 Langfuse의 ClickHouse 인수와 Opik의 가드레일 특화 전략은 향후 운영 환경 구축에 있어 중요한 선택 기준이 됩니다.
Opik vs Langfuse: Where Two Open-Source LLM Observability Tools Actually Agree (and Where They Don't)↗dev.to
- 12
이 예측의 원본 URL은 11년 뒤(2011)부터 사용할 수 없을 것입니다.
웹 링크의 영속성을 주제로 Jeremy Keith와 Matthew A Haughey가 벌인 11년 기간의 장기 베팅 내용을 소개합니다. 웹 문서의 자연스러운 소멸을 주장하는 측과 현대 기술로 안정적인 URI 유지가 가능하다는 측이 대립하며, 결과에 따라 기부처가 결정되는 흥미로운 실험입니다.
The original URL for this prediction will no longer be available in 11 years (2011)↗longbets.org
- 14
주간 19호: Cloudflare 이메일 라우팅, 위키데이터 인용, 그리고 스스로를 계속 인용하는 벤치마크
Convertify는 Wikidata와 JSON-LD를 활용해 AI 검색 엔진에서의 신뢰도를 높이는 전략을 통해 Bing Copilot의 인용 성능을 3.1배 상승시켰습니다. 또한 Cloudflare Email Routing을 통한 브랜드 이메일 구축의 효율성과 이미지 처리 과정에서 발생한 기술적 부채 문제를 함께 다루고 있습니다.
Week 19: Cloudflare Email Routing, Wikidata citations, and the benchmark that keeps citing itself↗dev.to
- 21
Show HN: ExpertCache - 16GB M1 Pro에서 GPT-OSS 120B(63GB) 전체 실행하기
ExpertCache는 Apple Silicon에서 모델 전체를 메모리에 올리지 않고도 거대 MoE(Mixture-of-Experts) 체크포인트를 실행할 수 있는 실험적 Metal 런타임입니다. 16GB M1 Pro 환경에서도 63GB 규모의 GPT-OSS 120B 모델을 구동하는 데 성공하며, 비록 속도는 매우 느리지만 하드웨어 제약을 넘어선 기능적 구현 가능성을 입증했습니다.
Show HN: ExpertCache – Run the Full GPT-OSS 120B (63GB) on a 16GB M1 Pro↗github.com



















