NVIDIA, 4,999달러부터 시작하는 'DGX Spark 64GB' 데스크톱 AI 슈퍼컴퓨터 공개
NVIDIA가 최대 1,000억 개 매개변수 모델의 온디바이스 실행과 원활한 멀티 노드 클러스터링을 지원하는 데스크톱 슈퍼컴퓨터 'DGX Spark' 64GB 통합 메모리 버전을 공개했다.

NVIDIA가 클라우드 인프라에 의존하지 않고 로컬 환경에서 AI 워크로드를 구축 및 배포하려는 개발자, 연구원, 크리에이터를 위해 개인용 AI 슈퍼컴퓨터 'DGX Spark'의 새로운 64GB 구성을 선보였다. 10월 23일 금요일 출시 예정인 이 시스템의 가격은 4,999달러부터 시작하며, 하드웨어 파트너사인 Acer, ASUS, Dell, Gigabyte, HP, MSI를 통해서만 독점 공급된다.
이번 신규 에디션은 GB10 Grace Blackwell Superchip, 통합 메모리, DGX OS, 그리고 완전한 NVIDIA AI 소프트웨어 스택을 포함한 기존 128GB 모델의 아키텍처를 그대로 계승한다.
최대 1,000억 개 매개변수 모델 지원하는 온디바이스 추론
DGX Spark 64GB 시스템은 자율형 AI 에이전트, 파인튜닝(미세조정) 작업, 데이터 과학 파이프라인, 엣지 배포 등을 네이티브 환경에서 구동하도록 설계됐다. 단일 64GB 유닛만으로도 최대 1,000억 개 매개변수를 갖춘 오픈 모델을 기기에서 직접 구동할 수 있다.
별도 설정 없이 기본적으로 NVIDIA Agent Toolkit, CUDA-X AI 라이브러리, Nemotron 오픈 모델이 통합 제공된다. 아울러 llama.cpp, Ollama, vLLM, LM Studio, CUDA 기반 PyTorch 등 주요 개발자 추론 프레임워크 및 런타임을 지원한다. 크리에이티브 소프트웨어 분야에서는 3D 제작 제품군인 Blender가 향후 배포될 다운로드형 인스톨러를 통해 플랫폼 지원을 추가하는 첫 주요 애플리케이션 중 하나가 될 예정이다.
NVIDIA Sync를 통한 듀얼 유닛 클러스터링
단일 기기의 한계를 넘어서는 워크플로우를 위해 DGX Spark에는 NVIDIA ConnectX-7 네트워크 인터페이스 카드(NIC)가 내장됐다. 개발자는 전용 서버 인프라 없이도 QSFP 케이블을 사용해 200 GbE 패브릭 기반으로 두 시스템을 직접 연결할 수 있다.
64GB 유닛 2대를 클러스터링하면 메모리가 128GB로 풀링되어 메모리 대역폭이 2배로 증가하며, 최대 2,000억 개 매개변수를 지닌 모델의 온디바이스 실행이 가능해진다. NVIDIA가 Qwen 3.8 27B 모델을 대상으로 진행한 테스트에 따르면, 2개 노드로 구성된 클러스터는 단일 유닛 대비 최대 1.7배 향상된 성능을 기록했다.
클러스터링 과정은 하드웨어 연결 감지, 시스템 설정 검증, 네트워크 라우팅 구성을 자동으로 처리하는 NVIDIA Sync 앱과 해당 앱의 Cluster Assistant 기능을 통해 관리된다. 두 노드가 동일한 소프트웨어 스택을 공유하므로, 기존 단일 유닛 환경을 별도의 소프트웨어 재구성 없이도 2대 유닛으로 확장할 수 있다.
소프트웨어 생태계 및 출시 일정
NVIDIA는 10월 말 'NVIDIA Sync Model Launcher'를 공개할 계획이다. 이 도구를 활용하면 단일 노드 또는 멀티 노드 환경 전반에 걸쳐 클릭 한 번으로 Qwen3.8 27B를 다운로드하고 배포할 수 있으며, 모델을 로컬 클라이언트 노트북에 연결하고 웹 브라우저에서 직접 OpenCode 개발 툴을 설정할 수 있다.
또한 NVIDIA는 Acer, ASUS, Dell, HP, Lenovo, Microsoft, MSI 등 제조 파트너사들이 이번 달 NVIDIA RTX Spark 기반의 새로운 Windows PC를 선보인다고 덧붙였다. 한편 Alibaba의 경량 오픈 가중치 모델인 Qwen-Image-2.1은 이미지 생성 및 편집 작업을 위해 NVIDIA RTX GPU, DGX Spark, DGX Station 플랫폼 전반에서 로컬 구동을 지원한다.
DGX Spark 64GB 구성은 10월 23일부터 공인 제조 파트너사를 통해 공급될 예정이다.



