AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 49 페이지
- 2
ShadowSocial.io의 Likeness Lock v2.4: Qwen-Max 및 WAN 2.1을 활용한 딥페이크 엔지니어링, Zero-Idle-RAM ECS 환경에서 Caddy 리버스 프록시 사용
ShadowSocial.io는 대규모 AI 미디어 생성을 위해 Qwen-Max와 WAN 2.1을 최적화한 Likeness Lock v2.4를 출시했습니다. ECS의 Zero-Idle-RAM 설정을 통해 메모리 오버헤드를 최소화하고, Caddy 프록시로 트래픽을 효율적으로 관리하여 생성 속도를 극대화했습니다.
ShadowSocial.io's Likeness Lock v2.4: Engineering Deepfakes with Qwen-Max and WAN 2.1 on Zero-Idle-RAM ECS via Caddy Reverse Proxy↗dev.to
- 5
AI 엔진 변경은 10개 결과 중 3개를, 질문 변경은 10개 결과 모두에 영향을 미쳤다.
AI 엔진(ChatGPT, Gemini 등)을 교체했을 때는 추천 결과의 상당 부분이 일치했지만, 질문의 문구와 맥락을 변경했을 때는 추천 리스트가 완전히 뒤바뀌는 현상이 발견되었습니다. 특히 단순 카테고리 질문보다 구체적인 비즈니스 상황과 제약 조건을 포함한 질문에서 특정 제품이 새롭게 등장하는 것을 확인했습니다.
Changing the AI engine moved 3 of 10 results. Changing the question moved 10 of 10.↗dev.to
- 8
Qwen3.8 Max가 에이전트 인덱스에서 최고점을 차지하고, AMD는 모델을 실리콘에 새기는 기업을 인수했습니다.
Qwen3.8 Max가 에이전트 벤치마크에서 1위를 차지하며 모델의 성능과 추론 토큰 비용 간의 트레이드오프 논쟁을 불러일으켰습니다. 동시에 AMD는 모델을 실리콘에 직접 새겨 추론 비용을 혁신적으로 낮추려는 Taalas를 인수하며, AI 산업의 핵심 경쟁력이 '효율적인 추론 경제학'으로 이동하고 있음을 보여주었습니다.
Qwen3.8 Max Topped the Agentic Index — and AMD Bought a Company That Etches Models Into Silicon↗dev.to
- 16
스테이트 오리엔티드 일관성: 왜 단 하나의 정답을 찾기를 멈췄을까
분산 메시지 브로커 개발 중 발생한 OOM 장애를 통해, 모든 노드가 모든 클라이언트의 세션 상태를 보유하려 했던 잘못된 설계 패턴을 분석합니다. 시스템 전체에 단일한 일관성 전략을 적용하는 대신, 각 데이터(state)가 실제로 필요로 하는 최소한의 일관성 수준을 정의함으로써 불필요한 리소스 낭비와 확장성 한계를 극복할 수 있음을 제안합니다.
State-Oriented Consistency: Why We Stopped Looking for One Right Answer↗keel-iot.eu
- 17
ChatGPT의 GPT-5.6 솔 개선 및 무료 사용자 대상 접근성 확대
OpenAI가 ChatGPT 업데이트를 통해 Plus 및 Pro 사용자를 위한 GPT-5 모델의 답변 정밀도와 정보 집중도를 개선하고, 무료 사용자에게는 GPT-5.6 Luna 모델과 무제한 텍스트 채팅을 제공합니다. 특히 사용자가 응답의 사고 깊이를 직접 조절할 수 있는 슬라이더와 고난도 질문용 'Think' 버튼이 새롭게 도입되었습니다.
Improving GPT-5.6 Sol in ChatGPT—and expanding access for free users↗openai.com
- 19
Qwen3.8 Max, 에이전트 인덱스에서 최고 성능 모델로 평가받다
Artificial Analysis는 최신 인텔리전스 인덱스 v4.1.1을 통해 Qwen3.8 Max를 포함한 주요 모델들의 성능, 속도, 비용 효율성을 업데이트했습니다. 이번 업데이트는 에이전트 중심의 지식 작업 능력과 엔드포인트 정확도를 측정하는 새로운 지표들을 포함하며 AI 생태계의 변화를 반영하고 있습니다.
Qwen3.8 Max now ranked as the best overall model by agentic index↗artificialanalysis.ai
- 21
2026년, 인터넷 없는 Neural Network: 노트북과 스마트폰으로 무엇을 실행할 수 있을까
2026년 기준 온디바이스 AI는 하드웨어 사양과 양자화 수준에 따라 성능 편차가 매우 크며, 대규모 모델의 경우 클라우드 서비스 대비 속도와 컨텍스 창 측면에서 명확한 한계를 보입니다. 하지만 경량 모델을 활용하면 모바일 환경에서도 프라이버시가 보장된 효율적인 작업이 가능함을 보여줍니다.
Нейросеть без интернета в 2026 году: что реально потянет ваш ноутбук и телефон↗dev.to
- 23
ShadowSocial.io 해부: Likeness Lock v2.4 및 Zero-Idle-RAM Burst Orchestration을 활용한 Qwen-Max Modality Synthesis로 WAN 2.1 비디오 구현 on ECS
ShadowSocial.io는 Qwen-Max 모델을 활용해 텍스트, 이미지, 오디오를 결합한 WAN 2.1 규격의 비디오 생성 기술을 선보였습니다. Likeness Lock v2.4로 영상 내 캐릭터 일관성을 확보하고, ECS 기반의 Burst Orchestration으로 인프라 비용 최적화와 콜드 스타트 지연 시간 극복에 집중했습니다.
Deconstructing ShadowSocial.io: Qwen-Max Modality Synthesis to WAN 2.1 Video via Likeness Lock v2.4 and Zero-Idle-RAM Burst Orchestration on ECS↗dev.to




![[AI는 지금] 챗GPT 무료 '무제한' 선언…오픈AI, 구독 전략 다시 짠다](https://startupschool.cc/og/ai는-지금-챗gpt-무료-무제한-선언오픈ai-구독-전략-다시-짠다-e51f06.jpg)









