AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 140 페이지
- 9
Together AI, 오픈 모델을 위한 예측 가능하고 비용 효율적인 AI 추론 기능 공개
Together AI는 서버리스의 편리함과 전용 인프라의 안정성을 결합한 'Provisioned Throughput' 서비스를 공개했습니다. 이 서비스는 예약된 추론 용량과 토큰 기반 가격 정책, 9뮬 가동률 SLA를 통해 오픈 모델 운영 시 발생하는 비용 불확실성과 성능 변동성 문제를 해결하고자 합니다.
Together AI Unlocks Predictable, Cost-Effective AI Inference for Open Models↗dev.to
- 12
헤르메스 메모리 설치 업데이트: 클로드-옵시디언 융합 패턴 심층 분석 - 핫 캐시 (P0)
hermes-memory-installer의 최신 업데이트는 Claude와 Obsidian 간의 데이터 연동 시 발생하는 검색 병목 현상을 해결하기 위한 6가지 패턴을 제시하며, 그중 'Hotlar Cache'를 가장 중요한 P0 과제로 설정했습니다. 이 기능은 최근 사용된 메모리를 인메모리 캐시에 저장함으로써 임베딩 검색 없이 즉각적인 컨텍스트 참조를 가능하게 합니다.
hermes-memory-installer Update: Claude-Obsidian Fusion Patterns — Deep Dive into Hot Cache (P0)↗dev.to
- 18
해커들이 인기 있는 AI 도구 9개를 활용해 거대한 봇넷을 조립할 수 있다
연구자들은 LLM이 존재하지 않는 리소스 식별자를 생성하는 환각(Hallucination) 특성을 이용해 악성 코드를 심는 'HalluSquatting' 공격을 발표했습니다. 이 공격은 Cursor나 GitHub Copilot 같은 AI 코딩 에이전트가 잘못된 경로의 패키지를 스스로 내려받게 유도하여 대규모 봇넷이나 DDoS 공격에 활용될 수 있습니다.
Hackers can use 9 of the most popular AI tools to assemble massive botnets↗arstechnica.com















![[7월7일] AI가 벌어준 돈, 82%는 '인프라'의 몫...모델은 11% 불과](https://startupschool.cc/og/7월7일-ai가-벌어준-돈-82는-인프라의-몫모델은-11-불과-168365.jpg)



