AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 173 페이지
- 0
LLM 출력 품질이 여러 번 압축될 때 얼마나 저하되는지 측정해 본 적 있나요?
컨텍스트 압축이 반복될 때 LLM의 성능 저하 양상이 단순 선형적이지 않고 특정 지점에서 일시적 상승 후 급락하는 현상을 관찰했습니다. 현재 RULER나 Context Rot 같은 기존 벤치마크는 정적 입력 길이에만 집중하고 있어, 압축 반복에 따른 '압축 지속성(compaction persistence)'을 측정할 새로운 기준이 필요합니다.
Has Anyone Measured How LLM Output Quality Degrades Across Multiple Compactions?↗dev.to
- 2
OpenAI, 정부 요청에 따라 GPT-5.6 제한적 출시 후 “관례가 되어서는 안 된다”고 밝혀
OpenAI가 미국 정부의 압박으로 인해 GPT-5.6 시리즈(Sol, Terra, Luna)를 일부 파트너에게만 선공개하며, 향후 출시 프로세스에 대한 정부와의 협의를 진행 중입니다. 이번 모델은 강력한 에이전트 기능과 보안 강화를 특징으로 하지만, 정부의 사전 검토 요구로 인해 기술 접근성이 제한될 우려가 있습니다.
OpenAI limits GPT-5.6 rollout after government request, says restrictions shouldn’t be the norm↗techcrunch.com
- 5
OpenAI, GPT-5.6 Sol, Terra 및 Luna 모델 공개…현재는 제한된 프리뷰 파트너만 접근 가능, 미국 정부 발표에 따르면
OpenAI가 복잡한 코딩용 Sol, 비즈니스 업무용 Terra, 일상 자동화용 Luna로 구성된 GPT-5.6 모델 패밀리의 제한적 프리뷰를 발표했습니다. 이번 업데이트는 특정 작업에 최적화된 모델 분화를 통해 성능과 효율성을 동시에 극대화하는 데 초점을 맞추고 있습니다.
OpenAI unveils GPT-5.6 Sol, Terra and Luna models — but only accessible to limited preview partners for now, per US Gov↗venturebeat.com
- 13
AI 모델 대체 항목을 결정적 해시 풀로 관리하여 품질 향상
모든 모델 정보를 Claude와 같은 고비용 LLM으로 처리하는 대신, HuggingFace의 기존 메타데이터를 추출하여 구조화된 문장을 생성하는 규칙 기반(Rule-based) 보강 방식을 제안합니다. 이를 통해 API 비용을 절감하면서도 검색 엔진에 인덱싱 가능한 수준의 구체적인 정보를 대량으로 확보할 수 있습니다.
Upgrading fallback AI model entries to curated quality with a deterministic hash pool↗dev.to
- 14
글래스윙 서클 바깥에서: 왜 로컬 보안 CLI를 구축했는가
Anthropic은 강력한 사이버 공격 능력을 가진 Mythos 모델을 주요 인프라 기업들에게만 우선 제공하는 'Project Glasswing'을 운영 중이며, 일반 대중과 해외 사용자는 수출 규제 등으로 인해 접근이 제한된 상태입니다. 이에 대응하여 저자는 보안 혜택에서 소외된 개인 개발자와 오픈소스 유지보수자를 위해 로컬 환경에서 취약점을 탐지할 수 있는 Carapace를 구축했습니다.
Outside the Glasswing Circle: Why I Built a Local Security CLI↗dev.to
- 18
`ollama run`을 넘어: vLLM과 Nginx를 활용한 프로덕션 환경용 DeepSeek R1 배포
이 기사는 단순한 모델 실행을 넘어, Ubuntu와 Docker 환경에서 vLLM 엔진과 Nginx 리버스 프록시를 결합하여 보안성이 강화된 DeepSeek R1 배포 스택을 구축하는 방법을 다룹니다. 특히 멀티 GPU 통신 최적화 및 스트리밍 응답을 위한 Nginx 설정 등 실제 운영 환경에서 직면할 수 있는 기술적 난제 해결책을 제공합니다.
Beyond `ollama run`: Production-Ready DeepSeek R1 Deployment with vLLM and Nginx↗dev.to - 22
당신이 사용하는 모든 AI는 당신의 다른 조각을 기억한다. 그래서 나는 해결책을 만들었다.
LLMnesia는 ChatGPT, Claude, Gemini 등 여러 AI 서비스의 대화 기록을 로컬 환경에서 통합 검색하고, 특정 모델의 학습된 맥락을 다른 모델로 손쉽게 옮길 수 있는 크롬 확장 프로그램입니다. 사용자의 데이터를 외부 서버로 전송하지 않는 'Local-first' 방식을 채택하여 프라이버시를 보호하면서도 AI 간의 정보 단절 문제를 해결하고자 합니다.
Every AI you use remembers a different slice of you. So I built a fix.↗indiehackers.com
















