NVIDIA 뉴스
AI 반도체 시장을 주도하는 NVIDIA의 GPU, CUDA, 데이터센터 소식을 전합니다.
총 666건·최신 업데이트
- 101
NVIDIA GB300 NVL72에서 조정 가능한 추론 기능을 갖춘 2.4T 파라미터 모델 Qwen3.8-2.4T-A95B 서비스
알리바바가 공개한 2규모의 오픈 웨이트 모델 Qwen3.8-2.4T-A95B가 엔비디아 블랙웰 기반 GB300 NVL72에서 압도적인 추론 성능을 구현했습니다. 이 모델은 MoE 구조와 하이브리드 어텐션 기술을 통해 최대 100만 토큰의 긴 컨텍스트를 효율적으로 처리하며, 사용자가 작업에 따라 추론 깊이를 조절할 수 있는 기능을 제공합니다.
Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72↗developer.nvidia.com
- 104
HPE와 NVIDIA, 규제 산업 분야의 혁신을 지원하는 Sovereign AI의 복잡성 극복 강조
HPE와 NVIDIA는 데이터 및 인프라에 대한 완전한 통제권을 요구하는 규제 산업과 정부 기관을 위해 '소버린 AI' 전략을 추진합니다. 이들은 보안, 컴플라이언스, 프라이버시를 보장하는 맞춤형 AI 팩토리 솔루션을 통해 민감한 데이터를 현지 법규 내에서 안전하게 관리하며 혁신을 가속화할 수 있는 기반을 제공하고자 합니다.
Sovereign AI overcomes compliance challenges and feeds innovation in public sector and other regulated industries, say HPE and NVIDIA↗theregister.com
- 115
Nvidia 네모트론 3.5 라이트닝과 네모 스위치야드
엔비디아가 대규모 에이전트 시스템에 최적화된 30B 파라미터 규모의 MoE 모델인 Nemotron 3.5 Lightning과 효율적인 요청 분산을 지원하는 오픈소스 라이브러리 NeMo Switchyard를 발표했습니다. 이번 발표는 다양한 크기의 모델을 조합해 특정 작업에 최적화된 에이전트를 구축하고, 비용과 성능 사이의 균형을 맞추는 기술적 토대를 제공합니다.
Nvidia Nemotron 3.5 Lightning and NeMo Switchyard↗blogs.nvidia.com
- 116
NVIDIA JetPack 7.2.1, 에이전트 기반 비디오 기능 및 T3000 에뮬레이션 추가
NVIDIA JetPack 7.2.1은 개발자의 의도를 실제 하드웨어 성능으로 연결하는 '에이전트 기반 비디오 스킬'과 Python 환경에서의 고성능 영상 처리를 지원하는 PyNvVideoCodec 2.2를 도입했습니다. 또한, 상위 모델인 Thor에서 T3000 성능을 에뮬레이션할 수 있는 기능을 추가하여 효율적인 AI 비디오 파이프라인 개발을 지원합니다.
NVIDIA JetPack 7.2.1 Adds Agentic Video Skills and T3000 Emulation↗developer.nvidia.com
- 118
NVIDIA 네모트론 3.5 라이트닝, 장시간 실행 에이전트를 위한 빠르고 정확한 전문 작업 수행 제공
NVIDIA는 장시간 실행되는 AI 에이전트의 비용과 지연 시간을 줄이기 위해 최적화된 Nemotron 3.5 Lightning 모델을 공개했습니다. 이 모델은 30B MoE 구조를 통해 높은 정확도를 유지하면서도 기존 유사 규모 모델 대비 최대 4배 빠른 출력 속도를 제공하며, NeMo Switchyard를 통한 지능형 모델 라우팅을 지원합니다.
NVIDIA Nemotron 3.5 Lightning Delivers Fast, Accurate Specialized Task Execution for Long-Running Agents↗developer.nvidia.com
- 119
NVIDIA NeMo Switchyard로 모델에 걸쳐 AI 에이전트 워크로드 라우팅
NVIDIA NeMo Switchyard는 AI 에이전트가 작업의 난이도, 비용, 인프라 상태에 따라 최적의 모델(Frontier vs Specialized)을 선택하도록 돕는 SDK입니다. 이를 통해 개발자는 단일 모델 사용 시 발생하는 높은 비용과 지연 시간을 줄이면서도 필요한 수준의 정확도를 유지할 수 있습니다.
Route AI Agent Workloads Across Models with NVIDIA NeMo Switchyard↗developer.nvidia.com








![[AI 고속도로] 슈퍼마이크로, AI 인프라 호황에 매출 92%↑…내년 연매출 100조원 전망](https://startupschool.cc/og/ai-고속도로-슈퍼마이크로-ai-인프라-호황에-매출-92내년-연매출-100조원-전망-7bdfeb.jpg)




