NVIDIA 뉴스
AI 반도체 시장을 주도하는 NVIDIA의 GPU, CUDA, 데이터센터 소식을 전합니다.
총 670건·최신 업데이트
- 372
NVIDIA NeMo Automodel과 🤗Diffusers로 비디오 및 이미지 모델을 대규모로 파인튜닝하세요
NVIDIA NeMo Automodel과 Hugging Face Diffusers의 통합을 통해 FLUX, Wan 2.1 등 최신 확산 모델을 대규모 인프라에서 손쉽게 파인튜닝할 수 있게 되었습니다. 이 도구는 체크포인트 변환 없이 기존 생태계와 완호하며, 단일 GPU부터 수백 개의 GPU까지 코드 수정 없이 확장 가능한 학습 환경을 지원합니다.
Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers↗huggingface.co
- 376
GCE g2-standard에서 NVIDIA L4, MCP를 활용한 QAT 방식으로 Gemma 4 (26B) 배포하기
본 기사는 Google Cloud Engine(GCE)의 g2-standard 인스턴스와 NVIDIA L4 GPU를 사용하여 Gemma 4 (26B) 모델을 배포하는 최적화된 프로세스를 다룹니다. 특히 QAT 방식을 통해 모델 성능 저하를 최소화하면서도 메모리 효율성을 극대화하여 중급 사양의 하드웨어에서도 대형 모델 운영이 가능함을 입증합니다.
Deploy Gemma 4 (26B) with QAT on GCE g2-standard. Uses NVIDIA L4, MCP. https://dev.to/gde/26b-gemma-4-qat-deployment-with-gce-g2↗dev.to
- 377
NVIDIA BlueField를 활용한 극단적인 공동 설계로 에이전트형 AI 팩토리 확장하기
에이전트형 AI는 다수의 모델 및 도구 호출을 동반하므로, 인프라가 단순한 지원을 넘어 추론 프로세스의 일부로 통합되어야 합니다. NVIDIA는 BlueField-4 DPU와 STX 스토리지 프로세서를 통해 네트워크, 스토리지, 보안 작업을 CPU에서 오프로드함으로써 더 낮은 비용으로 높은 토큰 처리량과 효율적인 KV 캐시 관리를 구현합니다.
Scaling Agentic AI Factories Through Extreme Co-Design with NVIDIA BlueField↗developer.nvidia.com




![[단독] 정부, GPU 확보전 내년 '베라 루빈' 1만장 올인](https://startupschool.cc/og/단독-정부-gpu-확보전-내년-베라-루빈-1만장-올인-203b22.jpg)











