AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 157 페이지
- 0
Anthropic, 수출 제한 해제 후 Mythos 및 Fable 모델의 글로벌 접근 복구
미국 정부가 Anthropic의 Mythos 및 Fable 모델에 대한 수출 제한을 해제하며 전 세계 사용자의 접근을 허용했습니다. 특히 소프트웨어 취약점 탐지 능력이 뛰어난 Mythos 모델의 확산은 사이버 공격 위으로를 넓히고 기업의 보안 리스크 관리를 어렵게 만들 것으로 예상됩니다.
Anthropic Restores Global Access to Mythos and Fable Models After Export Restrictions Lifted↗dev.to
- 3
클로드 소네트 5.0, 논란을 피하기 위해 정중앙으로 곧게 나아갔다
Anthropic은 추론, 도구 사용, 코딩 능력이 대폭 향상된 '에이전트 최적화' 모델인 Claude Sonnet 5를 공개했습니다. 이번 버전은 비용 효율성을 높이는 동시에 규제 리스크를 피하기 위해 의도적인 사이버 보안 학습을 배제하고, 작업 난이도에 따라 연산량을 조절하는 새로운 기능을 도입한 것이 특징입니다.
Claude Sonnet 5.0 heads straight down the middle of the road to dodge controversy↗theregister.com
- 7
LIBR 추적: 소스 리지(ledger) 행과 바이트 단위 정확한 PDF 검증 (Show HN)
이 글은 금융 거래 내역을 순차적으로 재현하여 특정 자산의 추적 가능 금액을 계산하는 LIBR 기술의 결정론적 모델을 설명합니다. 입금과 출금 과정에서 발생하는 잔액 감소(dip)가 이후의 입금으로 복구되지 않는 비재충전(non-replenishment) 로직을 상태 머신 형태로 구현하여 회계적 검증 가능성을 확보했습니다.
Show HN: LIBR tracing with source ledger rows and byte-exact PDF verification↗exitprotocols.com
- 8
Show HN: 콘트라스트 언어-오디오 사전 학습을 이용한 기계적 결함 분류
cardiag는 유튜브나 틱톡 등에서 수집된 소음 섞인 오디오를 정제하여 자동차 결함 여부와 위치, 부품을 추론하는 엔드투엔드 머신러닝 파이프라인입니다. 단순한 진단을 넘어 모델이 판단하기 어려운 경우 '불확실'이라고 응답하도록 설계되어 신뢰성을 높였으며, 소음 제거 및 임베딩 기술의 재사용 가능성에 초점을 맞추고 있습니다.
Show HN: Classify mechanical faults using Contrastive Language-Audio Pretraining↗github.com
- 12
Anthropic, 가장 강력한 모델 개발 중단 후 AI 검증의 필요성을 제기
Anthropic은 최근 보안 취약점 노출로 인해 Fable 5 모델의 접근을 일시 중단했다가, 강화된 검증 레이어와 다층적 방어 체계를 도입하여 서비스를 재개했습니다. 이번 사건은 AI 모델의 지능이 상향 평준화됨에 따라, 출력물의 신뢰성과 검증 가능성이 향후 AI 산업의 핵심적인 해자(Moont)가 될 것임을 보여줍니다.
Anthropic Paused Its Most Capable Model, Then Made the Case for Verifying AI↗dev.to
- 14
토큰 보안 표면: 에이전트 AI, 기업 배포 환경에서의 ID 위험 초기 분석
에이전틱 AI가 자율적으로 기업 시스템에 접근하면서 기존의 권한 관리 체계(IAM)를 넘어선 새로운 보안 위협이 발생하고 있습니다. 특히 AI 에이전트에게 부여된 과도한 OAuth 권한과 API 토큰이 적절히 관리되지 않아 발생하는 '자격 증명 확산' 문제가 핵심 리스크로 부상했습니다.
First Look: Token Security Surfaces Agentic AI Identity Risks Across Enterprise Deployments↗dev.to
- 17
AI 모델 크기 때문에 네이티브 리액트 네이티브 다운로더 직접 만들었어요
대용량 AI 모델을 기기에 직접 다운로드해야 하는 오프라인 AI 앱 'Orb' 개발 과정에서 발생한 기술적 한계를 극복하기 위해 개발된 오픈소스 패키지입니다. 이 라이브러리는 JS 브릿지를 우회하여 네이티브 레이어에서 파일을 디스크에 직접 기록함으로써, 네트워크 불안정 상황에서도 이어받기가 가능한 안정적인 대용량 파일 다운로드 환경을 제공합니다.
I built a native React Native downloader because AI models are huge↗dev.to
- 19
누군가가 DeepSeek에게 브라우저 내 랜섬웨어 제작을 지시했고, 기꺼이 응했음
체크포인트 연구진은 DeepSeek이 브라우저 기반 랜랜섬웨어 제작을 위한 설계도를 생성했음을 발견했습니다. 이 공격 방식은 File System Access API를 악용해 사용자의 로컬 파일을 암호화하며, 누구나 간단한 프롬프트만으로 실행 가능한 수준의 공격 코드를 만들 수 있다는 점에서 매우 위험합니다.
Somebody told DeepSeek to build in-browser ransomware and it gleefully complied↗theregister.com
- 22
AWS GovCloud (US)에서 Amazon Bedrock에 NVIDIA Nemotron 및 OpenAI GPT OSS 모델 실행
AWS GovCloud(US) 환경의 Amazon Bedrock에 NVIDIA Nemotron 3 시리즈와 OpenAI GPT OSS 모델이 새롭게 추가되었습니다. 이를 통해 미 정부 기관 및 규제 산업 종사자들은 보안과 컴플라이언스를 유지하면서도 최신 오픈 웨이트 모델을 활용해 고성능 AI 애플리케이션을 구축할 수 있게 되었습니다.
Run NVIDIA Nemotron and OpenAI GPT OSS models on Amazon Bedrock in AWS GovCloud (US)↗aws.amazon.com
- 23
HippoRAG: 아마존 Bedrock, 아마존 Neptune 및 개인화된 PageRank를 활용한 신경생물학적 영감 RAG
이 기사는 인간 뇌의 해마 기능을 모방하여 복잡한 다단계 추론이 가능한 새로운 RAG 프레임워크인 HippoRAG의 AWS 기반 구현 방법을 소개합니다. Amazon Bedrock과 Neptune을 활용해 지식 그래프를 구축하고 Personalized Pagelar PageRank 알고리즘을 통해 문서 간 연결된 정보를 효율적으로 검색하는 아키텍처를 제시합니다.
HippoRAG: Neurobiologically inspired RAG using Amazon Bedrock, Amazon Neptune, and personalized PageRank↗aws.amazon.com













