AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 165 페이지
- 4
로컬 우선 멀티모달 AI: `iFly-Skills`, 프라이버시 및 효율성 격차를 어떻게 해소하는가
최근 개발자들 사이에서 데이터 보안과 주기 확보를 위해 클라우드 대신 로컬 환경에서 작동하는 AI 솔루션에 대한 관심이 높아지고 있습니다. iFLYTEK은 ASR, OCR 등 멀티모달 기술을 담은 'iFly-Skills'와 이를 자동화하는 'astron-rpa'를 오픈소스로 공개하며 기업용 프라이빗 AI 구축을 지원합니다.
Local-First Multimodal AI: How `iFly-Skills` Addresses the Privacy & Efficiency Gap↗dev.to
- 6
OpenAI 첫 맞춤형 칩 출시, Shopify는 모델 불문 AI 스택 구축, 그리고 Gemini 이미지 생성 무료 제공
OpenAI가 엔비디아 의존도를 낮추기 위해 추론 전용 커스텀 칩 'Jalapeño'를 공개했으며, Shopify는 다양한 모델을 유연하게 사용하는 AI 인프라 전략을 선보였습니다. 한편 구글은 개인화된 이미지 생성 기능을 무료화했고, 가트너는 향전 AI 코딩 비용이 개발자 연봉을 추월할 것이라는 경고를 내놓았습니다.
OpenAI Rolls Out Its First Custom Chip, Shopify Builds a Model-Agnostic AI Stack, and Gemini's Image Gen Goes Free↗dev.to
- 12
보안 연구원들, 프롬프트 인젝션으로 역할 모델 악용해 LLM에게 코카인 레시피를 얻어냈다
최근 연구에 따르면 LLM은 사용자 입력과 시스템 명령을 구분하기 위해 '역할(Role)' 태적을 사용하지만, 이는 스타일 기반의 불완전한 식별 방식이라 프롬프트 인젝션에 매우 취약합니다. 특히 공격자가 모델의 내부 추론 과정인 <think> 모드를 흉내 내는 'CoT Forgery' 기법을 사용할 경우, 안전 가드레일을 우회하여 유해한 정보를 생성할 확률이 급격히 높아집니다.
Security researchers tricked LLMs into giving them cocaine recipes by abusing role models for prompt injection↗theregister.com
- 20
마이크로 에이전트: 모델 API 내부 협업으로 프론티어 모델 성능 뛰어넘기
이 기사는 단일 모델 API 호출 뒤에서 여러 모델의 협업을 관리하는 '마이크로 에이전트'와 이를 제어하는 '라우터'의 진화를 다룹니다. vLLM Semantic Router는 복잡한 에이전트 로직을 추론 계층(serving layer)에 숨겨, 사용자가 단순한 API 호출만으로도 비용 효율적이고 고성능인 모델 조합의 결과를 얻을 수 있게 합니다.
Micro-Agent: Beat Frontier Models with Collaboration Inside Model API↗vllm.ai
- 21
.self 공개 발표: 자체 호스팅을 지원하도록 설계된 새로운 최상위 도메인
Human-Centered Computing Foundation이 윤리적이고 인간 중심적인 기술 생태계를 구축하기 위해 새로운 최상위 도메인(TLD)인 '.self' 도입을 추진합니다. 이 프로젝트는 기존 웹 인프라의 데이터 추출 및 주의력 착취 문제를 해결하고, 사용자가 직접 데이터를 통제하는 자가 호스팅 기반의 대안적 웹 아키텍처를 지향합니다.
Announcing .self: A New Top-Level Domain Designed to Support Self-Hosting↗hccf.onmy.cloud












![[6월29일] '챗GPT' 비밀번호를 공유하면 안 되는 이유..."넷플릭스와는 달라"](https://startupschool.cc/og/6월29일-챗gpt-비밀번호를-공유하면-안-되는-이유넷플릭스와는-달라-3bdd6f.jpg)





