AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 20 페이지
- 1
중국 AI 기업 집푸, 신규 모델이 엔트로픽, 오픈AI보다 버그 탐색 성능이 뛰어나다고 주장
중국 지푸(Zhipu)의 신규 모델 GLM-5.3이 사이버 보안 벤치마크인 CyberGym에서 미국 주요 AI 모델보다 뛰어난 버그 탐지 성능을 보였다고 발표했습니다. 이와 함께 한국 공정위의 애플·구글 앱스토어 규제 움직임과 인도의 승차 공유 서비스 팁 정책 금지 등 글로벌 테크 규제 소식도 전해졌습니다.
Chinese AI company Zhipu claims its new model is a better bug-finder than Anthropic, OpenAI↗theregister.com
- 7
Show HN: 저는 DeepSeek V4 Flash를 57GB로 줄였고, 제 Mac에서 컴파일러를 작성했습니다.
DeepSeek V4 Flash 모델의 파라미터를 약 80B개 제거하여 크기를 기존 대비 32.6% 줄인 코딩 특화형 MoEspresso 패키지가 발표되었습니다. 이 모델은 일반적인 텍스트 처리 능력은 다소 감소했으나, 코딩 및 에이전트 워크로드에 최적화되어 특정 작업에서 높은 효율성을 보여줍니다.
Show HN: I shrank DeepSeek V4 Flash to 57GB and it wrote a compiler on my Mac↗huggingface.co
- 10
폰은 이제 카메라이자 어두운 방: 모바일 부동산 사진 파이프라인이 실제로 온디바이스에서 어떻게 작동하는가
부동산 사진 편집 서비스 개발 시, 단순 광학 보정은 스마트폰 로컬에서 처리하고 생성형 AI 작업은 서버 GPU로 넘기는 하이브리드 아키텍처가 가장 효율적이다. 웹 앱 방식을 통해 설치 허들을 낮추면서도, 연산의 성격에 따라 기기와 서버의 역할을 명확히 나누는 것이 핵심이다.
The Phone Is Now the Camera and the Darkroom: What a Mobile Real Estate Photo Pipeline Actually Runs On-Device↗dev.to
- 20
Show HN: GPU 레지스터 내 유체 역학을 이용한 광컴퓨팅 지터 수정
이 프로젝트는 광학 트랜시버의 열 변동으로 발생하는 광 신호 지터를 최소화하기 위해 GPU 레지스터를 활용한 새로운 제어 방식(PoC)을 제시합니다. 소프트웨어 버퍼링 대신 비트 연산과 레지스터 워핑 기술을 통해 데이터 전송 지연을 0ns에 가깝게 줄이고 초거대 AI 모델의 수치적 안정성을 유지하는 것을 목표로 합니다.
Show HN: Fixing optical computing jitter via fluid dynamics in GPU registers↗github.com
- 21
LLM이 초등학교 수준 자료 이상을 접하지 못하면 어떤 일이 벌어질까?
LittleLearner 연구는 초등학교(K-5) 수준의 데이터로만 학습된 모델을 통해 사전 학습 데이터가 LLM의 능력 상한선을 결정한다는 사실을 입증했습니다. 모델 크기 확대, GRPO 기반 사후 학습, 인컨텍스트 러닝 모두 학습 범위 내의 능력은 강화하지만 범위를 벗어난 고차원적 지식 습득에는 한계를 보였습니다.
What happens when an LLM never sees material beyond fifth grade?↗littlelearner-ll.github.io


















