AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 43 페이지
- 8
이 예측의 원본 URL은 11년 뒤(2011)부터 사용할 수 없을 것입니다.
웹 링크의 영속성을 주제로 Jeremy Keith와 Matthew A Haughey가 벌인 11년 기간의 장기 베팅 내용을 소개합니다. 웹 문서의 자연스러운 소멸을 주장하는 측과 현대 기술로 안정적인 URI 유지가 가능하다는 측이 대립하며, 결과에 따라 기부처가 결정되는 흥미로운 실험입니다.
The original URL for this prediction will no longer be available in 11 years (2011)↗longbets.org
- 10
주간 19호: Cloudflare 이메일 라우팅, 위키데이터 인용, 그리고 스스로를 계속 인용하는 벤치마크
Convertify는 Wikidata와 JSON-LD를 활용해 AI 검색 엔진에서의 신뢰도를 높이는 전략을 통해 Bing Copilot의 인용 성능을 3.1배 상승시켰습니다. 또한 Cloudflare Email Routing을 통한 브랜드 이메일 구축의 효율성과 이미지 처리 과정에서 발생한 기술적 부채 문제를 함께 다루고 있습니다.
Week 19: Cloudflare Email Routing, Wikidata citations, and the benchmark that keeps citing itself↗dev.to
- 17
Show HN: ExpertCache - 16GB M1 Pro에서 GPT-OSS 120B(63GB) 전체 실행하기
ExpertCache는 Apple Silicon에서 모델 전체를 메모리에 올리지 않고도 거대 MoE(Mixture-of-Experts) 체크포인트를 실행할 수 있는 실험적 Metal 런타임입니다. 16GB M1 Pro 환경에서도 63GB 규모의 GPT-OSS 120B 모델을 구동하는 데 성공하며, 비록 속도는 매우 느리지만 하드웨어 제약을 넘어선 기능적 구현 가능성을 입증했습니다.
Show HN: ExpertCache – Run the Full GPT-OSS 120B (63GB) on a 16GB M1 Pro↗github.com




















