AI RACE— Cuộc đua AI
Model mới

NVIDIA ra mắt siêu máy tính để bàn AI DGX Spark 64GB với giá từ 4.999 USD

NVIDIA vừa công bố phiên bản bộ nhớ hợp nhất 64GB của mẫu siêu máy tính để bàn DGX Spark, cho phép chạy cục bộ các mô hình lên tới 100 tỷ tham số và hỗ trợ ghép cụm đa node liền mạch.

20:00 02/10/2026
NVIDIA ra mắt siêu máy tính để bàn AI DGX Spark 64GB với giá từ 4.999 USD

NVIDIA vừa giới thiệu phiên bản cấu hình 64GB mới cho mẫu siêu máy tính AI cá nhân DGX Spark, mở rộng thêm lựa chọn cho các nhà phát triển, nhà nghiên cứu và người sáng tạo nội dung muốn xây dựng cũng như triển khai các tác vụ AI cục bộ mà không phải phụ thuộc vào hạ tầng đám mây. Dự kiến lên kệ vào thứ Sáu, ngày 23/10, hệ thống có giá khởi điểm từ 4.999 USD và sẽ được phân phối độc quyền thông qua các đối tác phần cứng gồm Acer, ASUS, Dell, Gigabyte, HP và MSI.

Phiên bản mới vẫn giữ nguyên kiến trúc của model 128GB, bao gồm siêu chip GB10 Grace Blackwell Superchip, bộ nhớ hợp nhất (unified memory), hệ điều hành DGX OS cùng trọn bộ phần mềm NVIDIA AI.

Suy luận trực tiếp trên thiết bị cho các mô hình lên tới 100 tỷ tham số

Hệ thống DGX Spark 64GB được thiết kế để chạy trực tiếp (native) các tác nhân AI tự động (AI agent), quy trình tinh chỉnh mô hình (fine-tuning), xử lý khoa học dữ liệu và triển khai tại biên (edge). Chỉ với một cỗ máy 64GB duy nhất, người dùng đã có thể chạy các mô hình nguồn mở có quy mô lên tới 100 tỷ tham số ngay trên thiết bị.

Ngay khi xuất xưởng, máy đã được tích hợp sẵn NVIDIA Agent Toolkit, các thư viện CUDA-X AI và các mô hình mở Nemotron. Thiết bị hỗ trợ đầy đủ các framework và runtime suy luận then chốt cho lập trình viên, bao gồm llama.cpp, Ollama, vLLM, LM Studio và PyTorch cùng CUDA. Ở mảng ứng dụng sáng tạo, bộ công cụ dựng hình 3D Blender là một trong những cái tên lớn đầu tiên hỗ trợ nền tảng này thông qua một bản cài đặt sắp ra mắt.

Ghép cụm hai máy thông qua NVIDIA Sync

Đối với những quy trình làm việc vượt quá giới hạn phần cứng của một máy đơn lẻ, DGX Spark đã trang bị sẵn card mạng tích hợp NVIDIA ConnectX-7 (NIC). Lập trình viên có thể kết nối trực tiếp hai hệ thống với nhau bằng cáp QSFP qua hạ tầng mạng 200 GbE mà không cần đến bộ chuyển mạch (switch) chuyên dụng.

Việc ghép cụm hai máy 64GB sẽ gom bộ nhớ chung lên mức 128GB, nhân đôi băng thông bộ nhớ và cho phép chạy trực tiếp các mô hình có quy mô lên đến 200 tỷ tham số. Trong các thử nghiệm nội bộ của NVIDIA với mô hình Qwen 3.8 27B, thiết lập cụm hai node đạt hiệu năng tăng tới 1,7 lần so với khi chạy trên một máy đơn lẻ.

Quá trình ghép cụm này được quản lý thông qua ứng dụng NVIDIA Sync và tính năng Cluster Assistant đi kèm, cho phép tự động phát hiện kết nối phần cứng, kiểm tra cài đặt hệ thống và cấu hình định tuyến mạng. Do cả hai node đều dùng chung một bộ phần mềm đồng nhất, môi trường làm việc trên máy đơn hiện tại có thể mở rộng liền mạch lên cụm hai máy mà không cần cấu hình lại phần mềm.

Hệ sinh thái phần mềm và thời điểm mở bán

NVIDIA dự kiến sẽ phát hành công cụ NVIDIA Sync Model Launcher vào cuối tháng 10. Công cụ này cho phép tải xuống và triển khai Qwen 3.8 27B chỉ với một cú nhấp chuột trên cả cấu hình máy đơn lẫn đa node, đồng thời chia sẻ mô hình tới các máy tính xách tay client trong mạng nội bộ và thiết lập công cụ phát triển OpenCode trực tiếp ngay trên trình duyệt web.

NVIDIA cũng lưu ý rằng các đối tác sản xuất phần cứng – bao gồm Acer, ASUS, Dell, HP, Lenovo, Microsoft và MSI – đang bắt đầu xuất xưởng các dòng máy tính Windows mới trang bị NVIDIA RTX Spark ngay trong tháng này. Song song đó, mô hình trọng số mở gọn nhẹ Qwen-Image-2.1 của Alibaba hiện đã được hỗ trợ chạy cục bộ trên toàn bộ dải sản phẩm GPU NVIDIA RTX, DGX Spark và DGX Station để phục vụ các tác vụ tạo và chỉnh sửa hình ảnh.

Cấu hình DGX Spark 64GB sẽ chính thức được mở bán từ ngày 23/10 thông qua các đối tác sản xuất được ủy quyền.

◗ Nguồn

NVIDIA Blog02-10

Tin liên quan