AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 118 페이지
- 2
전 OpenAI 최고기술책임자는 일터먼이 하지 못하는 일을 하다: 진정한 오픈 소스 최첨단 AI 모델 공개
전 OpenAI CTO 미라 무라티가 설립한 Thinking Machines Lab이 9750억 개의 파라미터를 가진 대규모 오픈 웨이트 모델 'Inkling'을 출시했습니다. Apache 2.0 라이선스로 공개된 이 모델은 강력한 추론 능력과 100만 토큰의 컨텍스트 창을 지원하며, 개발자들이 자유롭게 미세 조정할 수 있는 환경을 제공합니다.
Former OpenAI CTO does what Altman won't: releases a frontier AI model that's actually open↗theregister.com
- 4
마이크로소프트, 영업사원들에게 OpenAI와 Anthropic에 대한 부정적인 언급을 지시하는 것으로 알려져
마이크로소록프트가 영업 전략의 일환으로 OpenAI, Anthropic 등 기존 파트너사들의 모델을 폄하하며 자사 제품의 효율성과 통합성을 강조하도록 지시한 것으로 알려졌습니다. 이는 비용 절감과 시장 점유율 확대를 위해 외부 모델 의존도를 낮추고 자체 AI 생태계를 강화하려는 전략적 움직임으로 풀이됩니다.
Microsoft is reportedly training salespeople to talk down OpenAI and Anthropic↗techcrunch.com
- 8
Thinky의 Inkling: 975B-A41B 멀티모달, 새로운 최고 미국 Apache 2.0 오픈 모델 (Inkling-Small, 276B-A12B 포함)
Thinking Machines Lab이 Apache 2.0 라이선스의 대규모 멀티모달 MoE 모델인 Inkling 시리즈를 출시했습니다. 이 모델은 총 975B 파라미터 중 41B만 활성화하여 추론 효율성을 극대화했으며, 텍스트뿐만 아니라 이미지와 오디오를 네이티브하게 처리할 수 있는 능력을 갖추고 있습니다.
[AINews] Thinky's Inkling: 975B-A41B multimodal, new best American Apache 2.0 open model (with Inkling-Small, 276B-A12B)↗latent.space
- 11
13년 된 제온에서 GPU 없이 5 토큰/초로 Gemma 4 26B 실행하기
작성자는 AVX2 명령어가 없는 1<0xA0>13년 된 구형 Xeon 서버에서 Gemma 4 26B 모델을 초당 약 5토큰의 속도로 구동하는 데 성공했습니다. 이 과정에서 Claude와 같은 AI 에이전트를 활용해 최적화된 C++ 코드를 수정하고 하드웨어 제약을 극복하며, 저비용으로 로컬 LLM 운영이 가능함을 증명했습니다.
Running Gemma 4 26B at 5 tokens/sec on a 13-year-old Xeon with no GPU↗neomindlabs.com
- 13
AI의 심판: 왜 미국의 AI 모델은 지속 불가능하며 경쟁력을 잃고 있는가
미국의 주요 AI 제공업체들이 사용량 기반 과금 체계 전환과 에너지 수요 급증, 지정학적 불확실성에 직면하며 시장 주도권이 분산되고 있습니다. 기업들은 이제 성능 차이가 줄어든 상황에서 훨씬 저렴한 중국 및 유럽의 오픈 웨이트 모델을 활용해 비용 효율성과 데이터 주권을 확보하려는 움직임을 보이고 있습니다.
The AI Reckoning: Why U.S. AI Models Are Unsustainable & Losing Their Edge↗esgnews.com
- 14
Lattice: Apple Silicon에 최적화된 순수 Rust LLM 엔진
Lattice는 Python이나 C++ 같은 무거운 런타임 없이 Apple Silicon의 성능을 극한으로 끌어올리기 위해 Rust로 작성된 로컬 AI 엔진입니다. Metal Shader와 ARM NEON을 활용해 추론, 양자화, LoRA 미세 조정을 지원하며, SwiftUI 기반의 Lattice Studio를 통해 시각적인 개발 환경을 제공합니다.
Lattice: The Pure Rust LLM Engine Optimized for Apple Silicon↗dev.to
- 15
GPT-5.6 솔 공개: OpenAI의 주력 모델, 정부 검토를 통과하며 역대 최고 91.9% 코딩 점수 기록
OpenAI가 강력한 보안 및 코딩 능력을 갖춘 GPT-5.6 모델군(Sol, Terra, Luna)을 공식 출시했습니다. 이번 모델은 미 정부의 보안 검토를 통과했으며, 용도와 비용에 따른 세분화된 가격 정책을 통해 기업용 AI 시장 공략을 가속화할 전망입니다.
GPT-5.6 Sol Goes Public: OpenAI's Flagship Breaks Government Review with Record 91.9% Coding Score↗dev.to
- 21
오픈 웨이트 LLM API 통합: 블랙박스 모델 없이 AI 기반 앱 개발자를 위한 가이드
이 기사는 OpenAI와 같은 블랙박스 모델의 한계를 극복하기 위해 오픈 웨이트 LLM을 활용하는 방법을 다룹니다. NovaStack과 같은 API 레이어를 통해 복잡한 인프라 관리 없이도 투명하고 비용 효율적인 AI 애플리케이션을 구축할 수 있는 실질적인 방안을 제안합니다.
Open-Weight LLM API Integration: A Developer's Guide to Building AI-Powered Apps Without BlackBox Models↗dev.to




![[7월15일] 구글의 차례가 왔다…시장이 '제미나이 3.5 프로'를 기다리는 이유](https://startupschool.cc/og/7월15일-구글의-차례가-왔다시장이-제미나이-35-프로를-기다리는-이유-12fbb6.jpg)










