NVIDIA DGX Spark
다양한 구성의 제품을 장바구니에서 구분하기 위해 사용하세요 — 동일한 제품을 다른 옵션으로 주문할 때 유용합니다.
전체 사양
컴퓨팅 및 메모리
칩
NVIDIA GB10 Grace Blackwell 슈퍼칩
CPU
20코어 Arm (10 × Cortex-X925 + 10 × Cortex-A725)
통합 메모리
128GB LPDDR5x (273GB/s 대역폭)
AI 성능
1 페타플롭스 (FP4)
스토리지 및 물리적 사양
스토리지
4TB NVMe SSD, 자체 암호화 (PCIe Gen4)
치수
150 × 150 × 50.5 mm
무게
1.2 kg
디스플레이 출력
최대 3대 동시 디스플레이 (HDMI + USB4 DisplayPort alt-mode)
전원 및 네트워킹
전원 공급 장치
240W USB-C PD 어댑터
네트워킹
NVIDIA ConnectX-7 스마트 NIC, 듀얼 200Gbps QSFP + 10GbE RJ-45
무선
Wi-Fi 7, 블루투스 5.4
소프트웨어 및 보안
운영 체제
NVIDIA DGX OS (Ubuntu 24.04 LTS), 전체 CUDA AI 스택 사전 설치
에이전트형 AI
NemoClaw 샌드박스 에이전트 프레임워크 포함
보안
TPM 2.0, 시큐어 부트, 자체 암호화 SSD
NVIDIA DGX Spark는 NVIDIA GB10 Grace Blackwell Superchip을 위한 레퍼런스 데스크탑 시스템으로, 2025년 1월 Project DIGITS라는 코드명으로 처음 공개된 후 최종 명칭으로 출시되었습니다. NVIDIA가 직접 설계하고 검증하며 지속적으로 업데이트하는 플랫폼으로, FP4 AI 성능 1 페타플롭과 128GB의 일관된 통합 메모리를 1.2kg의 인클로저에 담아 키보드 옆 책상에 놓을 수 있을 만큼 작습니다.
DGX Spark는 NVIDIA 자체 레퍼런스 디자인이므로, 새로운 GB10 생태계 기능이 가장 먼저 검증되는 플랫폼이기도 합니다. 2026년 3월 말 NVIDIA GTC 2026 컨퍼런스 이후, 4노드 RoCE 클러스터링 지원(단일 배포에서 공유 통합 메모리를 512GB로 확장)이 파트너 하드웨어에 채택되기 전에 DGX Spark에서 먼저 확인되었으며, 이는 이미 GB10 라인업 전체에 표준으로 적용된 2유닛 직접 연결 기능과 함께 제공됩니다.
하드웨어 사양
그 핵심에는 NVIDIA GB10 Grace Blackwell Superchip이 있으며, 20코어 Arm 프로세서(10 × Cortex-X925 성능 코어 + 10 × Cortex-A725 효율 코어)와 5세대 Tensor Core 및 네이티브 FP4 희소성 지원을 갖춘 Blackwell 세대 GPU를 결합했습니다. 두 요소는 CPU와 GPU 간에 공유되는 273 GB/s의 일관된 대역폭을 제공하는 128 GB LPDDR5x 통합 메모리로 연결되어, 일반적으로 별도의 CPU/GPU 메모리 풀에서 발생하는 복사 오버헤드를 제거합니다. 저장 장치는 4TB 자체 암호화 PCIe Gen4 NVMe SSD로, 대규모 모델 체크포인트와 데이터셋을 로컬에 저장할 수 있는 크기입니다.
소프트웨어: 사전 설치된 전체 NVIDIA AI 스택
DGX Spark는 NVIDIA DGX OS(Ubuntu 24.04 LTS)와 완전한 NVIDIA AI 소프트웨어 스택이 하드웨어에 대해 사전 설치 및 검증된 상태로 출하됩니다. CUDA, cuDNN, TensorRT 및 NVIDIA Container Runtime이 첫 부팅 시 준비됩니다. NVIDIA NIM 마이크로서비스를 통해 지원되는 모델을 수동 조정 없이 최적화된 추론 컨테이너로 배포할 수 있으며, 워크로드가 나중에 NVIDIA DGX Cloud 또는 데이터센터 DGX 시스템으로 이동할 때 동일한 컨테이너를 변경 없이 사용할 수 있습니다. 지속적으로 유지 관리되는 공식 플레이북 세트는 vLLM 및 TensorRT-LLM 서빙부터 NeMo 및 Unsloth를 사용한 파인튜닝에 이르는 일반적인 워크플로를 다루어 초보자와 고급 사용자 모두의 설정 시간을 단축합니다.
에이전트 기반 AI 워크로드를 위해 DGX Spark는 NemoClaw를 포함합니다. 이는 NVIDIA의 샌드박스된 에이전트 실행 계층으로, 자율 에이전트 주변의 정책 기반 액세스 제어를 적용하고 감사 목적으로 해당 작업을 기록하며, 최근 DGX OS 업데이트에서 측정 가능한 수준으로 빠른 로컬 에이전트 추론을 제공하도록 최적화되었습니다.
연결성 및 네트워킹
네트워킹은 듀얼 200Gbps QSFP 포트를 갖춘 NVIDIA ConnectX-7 Smart NIC을 중심으로 구축되어, 직접 유닛 간 연결 또는 대규모 배포 시 관리형 RoCE 스위치 패브릭에 연결하는 데 사용됩니다. 추가적인 온보드 연결성에는 10GbE 이더넷(RJ-45), Wi-Fi 7, Bluetooth 5.4이 포함됩니다. 4개의 USB4 Type-C 포트는 HDMI와 함께 로컬 다중 모니터 사용(최대 3개의 동시 디스플레이)을 위한 DisplayPort 출력을 지원하여 동일한 유닛이 개발 워크스테이션과 상시 가동 추론 서버로 사용될 수 있게 합니다.
엔터프라이즈 관리 및 보안
DGX Spark는 인터넷 연결이 없는 환경을 위한 에어 갭 배포를 지원하며, Cloud-init을 통한 사용자 정의 ISO 생성 및 USB 기반 OS 및 드라이버 업데이트를 포함하여, 외부 네트워크 의존 없이 함대를 프로비저닝하고 유지할 수 있게 합니다. 저장 장치는 기본적으로 자체 암호화되며, 플랫폼에는 TPM 2.0 및 Secure Boot가 포함되어 처리 과정이 완전히 온프레미스로 유지되어야 하는 규제된 데이터 민감한 배포에 적합한 보안 기준을 제공합니다.
확장성: 단일, 2유닛 및 4유닛 구성
단일 DGX Spark는 로컬에서 약 2000억 개의 매개변수를 가진 모델을 편리하게 서비스할 수 있습니다. 더 큰 모델의 경우, 두 유닛이 ConnectX-7 QSFP 포트를 통해 직접 연결되어 256GB 통합 메모리 풀로 결합되며, 최대 4개의 유닛이 관리형 200GbE RoCE 스위치 패브릭을 통해 512GB 일관된 풀로 결합될 수 있습니다. 이는 GTC 2026에서 NVIDIA가 검증한 것과 동일한 클러스터링 경로입니다.
| 구성 | 총 통합 메모리 | 연결 | 최대 모델 매개변수 |
|---|---|---|---|
| 단일 유닛 | 128 GB | 해당 없음 | ~2000억 |
| 2유닛 클러스터 | 256 GB | 직접 QSFP DAC, 200 Gbps | ~4000억 |
| 4유닛 클러스터 | 512 GB | 관리형 RoCE 200 GbE 스위치 패브릭 | 7000억+ |
생태계 및 장기적 확장 경로
DGX Spark는 NVIDIA DGX Cloud 및 데이터센터 DGX 시스템 전반에 사용되는 동일한 DGX OS 및 NVIDIA AI 소프트웨어 스택을 실행하므로, 로컬에서 개발된 워크로드(컨테이너, NIM 배포, 파인튜닝 파이프라인)는 데스크탑 프로토타입에서 대규모 프로덕션 배포로 이동할 때 수정 없이 이전됩니다.









