AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 99 페이지
- 0
Gemini 최신 모델: temperature, top_p, top_k 속성이 더 이상 사용되지 않으며 무시됩니다.
구글은 고성능 에이전트 작업을 위한 Gemini 3.6 Flash와 초고속·저비용 처리에 최적화된 Gemini 3.5 Flash-Lite를 정식 출시했습니다. 이번 업데이트는 새로운 Interactions API 도입과 함께 추론 능력 향상, 비용 절감, 그리고 'Computer Use'와 같은 에이전트 기능 강화를 핵심으로 합니다.
Gemini last models: temperature, top_p, and top_k are deprecated and ignored↗ai.google.dev
- 1
판사, 클로드 학습에 불법 도서 사용한 Anthropic의 15억 달러 합의 승인
Anthropic이 클로드 학습에 저작권이 있는 도서를 불법 경로로 사용한 것에 대해 작가 및 출판사들에게 총 15억 달러를 지급하는 합의안을 법원으로부터 승인받았습니다. 이번 합의는 AI 모델 학습 과정에서의 데이터 수집 방식과 저작권 침해 여부에 대한 대규모 보상 사례로 기록될 예정입니다.
Judge approves $1.5B Anthropic settlement for pirated books used to train Claude↗apnews.com
- 2
GPT-5.6, Claude, Gemini, 그리고 Grok으로 모나리자를 “그리기”
본 기사는 AI 모델에게 색연필 도구를 부여하여 이미지를 그리게 하는 'Canvas Arena' 실험 결과를 다룹니다. GPT-5.6 Sol은 우수한 성능을 보인 반면, Claude Fable 5는 높은 비용과 시간 대비 낮은 품질을 기록했으며, Grok 4.5와 오픈 웨이트 모델들은 기초적인 작업 수행에 한계를 드러냈습니다.
"Drawing" the Mona Lisa with GPT-5.6, Claude, Gemini, and Grok↗tryai.dev
- 4
키미 K3, 페이블과 경쟁력 갖춰; 키미 K3와 페이블은 SOTA
오픈 모델인 Kimi K3와 폐쇄형 모델 Fable 5를 비교 분석한 결과, 작업 성격에 따라 두 모델을 적절히 배분하는 라우팅 기술이 성능과 비용 효율성을 동시에 극대화할 수 있음이 증명되었습니다. 특히 특정 에이전트 루프에서는 K3 활용 시 Fable 대비 최대 50배의 비용 절감이 가능하며, 이를 통해 SOTA급 지능을 유지하면서도 운영 비용을 획기적으로 낮출 수 있습니다.
Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA↗fireworks.ai
- 10
모델별로 초안 프롬프트를 수정하는 사전 연구 자료 아시는 분 계신가요?
한 개발자가 사용자의 거친 초안 프롬프트를 Claude, GPT, Gemini 등 각 LLM의 특성에 맞춰 최적화된 형태로 재작성해주는 자동화 도구 아이디어를 제안하며 관련 선행 연구를 찾고 있습니다. 이는 단순히 문장을 다듬는 것을 넘어 모델별 고유한 강점과 약점을 활용하는 '모델 맞춤형 프롬프트 적응' 기술에 초점을 맞추고 있습니다.
Anyone know prior research on rewriting a rough prompt per model?↗dev.to
- 12
저는 250개의 다양한 AI API를 호출합니다. 이 게이트웨이는 하나의 엔드포인트로 제공합니다.
OmniRoute는 다양한 AI API의 복잡한 인증, 레이트 리밋, 비용 문제를 해결하기 위해 OpenAI 호환 엔드포인트를 제공하는 오픈소스 게이트웨이입니다. 실시간 상태에 따른 최적 모델 선택, 4단계 자동 폴백 시스템, 그리고 토큰 사용량을 최대 95%까지 줄여주는 압축 엔진을 통해 AI 워크플로우의 안정성과 경제성을 동시에 확보합니다.
I Call 250 Different AI APIs. This Gateway Gives Me One Endpoint Instead.↗dev.to
- 14
OpenAI/Hugging Face 사건, 모델 평가 보안에 대한 경종이다
최근 발생한 OpenAI와 Hugging Face의 보안 사고는 모델 평가(Evaluation) 프로세스가 외부 코드 실행을 허용하는 RCE(원격 코드 실행) 공격의 통로가 될 수 있음을 경고합니다. 평가 환경이 적절히 격리되지 않은 채 프라이빗 데이터에 접근할 경우, 모델의 출력이 시스템 전체를 위협하는 공격 벡터로 변질될 수 있습니다.
The OpenAI/Hugging Face Incident is a Wake-Up Call for Model Eval Security↗dev.to
















