NVIDIA apresenta supercomputador de IA para desktop DGX Spark de 64 GB a partir de US$ 4.999
A NVIDIA revelou uma versão com 64 GB de memória unificada do supercomputador desktop DGX Spark, oferecendo execução local para modelos de até 100 bilhões de parâmetros e clustering multinó descomplicado.

A NVIDIA anunciou uma nova configuração de 64 GB do seu supercomputador pessoal de IA DGX Spark, expandindo as opções para desenvolvedores, pesquisadores e criadores que desejam criar e implementar cargas de trabalho locais de IA sem depender de infraestrutura em nuvem. Com lançamento previsto para sexta-feira, 23 de outubro, o sistema tem preço inicial de US$ 4.999 e estará disponível exclusivamente por meio das fabricantes parceiras Acer, ASUS, Dell, Gigabyte, HP e MSI.
A nova versão mantém a arquitetura do modelo de 128 GB, incluindo o GB10 Grace Blackwell Superchip, memória unificada, o sistema operacional DGX OS e a pilha completa de software NVIDIA AI.
Inferência no dispositivo para modelos de até 100 bilhões de parâmetros
O sistema DGX Spark de 64 GB foi desenvolvido para executar agentes autônomos de IA, tarefas de fine-tuning, pipelines de ciência de dados e implantações na borda (edge) de forma nativa. Uma única unidade de 64 GB é capaz de rodar modelos abertos de até 100 bilhões de parâmetros diretamente no dispositivo.
Pronto para o uso, o sistema traz integrado o NVIDIA Agent Toolkit, as bibliotecas CUDA-X AI e os modelos abertos Nemotron. Ele oferece suporte aos principais frameworks e runtimes de inferência voltados para desenvolvedores, incluindo llama.cpp, Ollama, vLLM, LM Studio e PyTorch com CUDA. No campo dos softwares de criação, a suíte de modelagem 3D Blender é uma das primeiras grandes aplicações a receber suporte à plataforma por meio de um instalador que será disponibilizado para download em breve.
Clustering de duas unidades via NVIDIA Sync
Para fluxos de trabalho que superam a capacidade de uma única máquina, o DGX Spark inclui uma placa de interface de rede (NIC) NVIDIA ConnectX-7 integrada. Os desenvolvedores podem interligar dois sistemas diretamente por meio de um cabo QSFP em uma estrutura de rede de 200 GbE, sem a necessidade de uma infraestrutura de servidores dedicada.
O agrupamento em cluster de duas unidades de 64 GB combina suas memórias para atingir 128 GB, dobrando a largura de banda de memória e viabilizando a execução local de modelos com até 200 bilhões de parâmetros. Em testes da NVIDIA com o Qwen 3.8 27B, a configuração em cluster de dois nós alcançou um ganho de desempenho de até 1,7x em relação a uma única unidade.
O processo de clustering é gerenciado pelo aplicativo NVIDIA Sync e pelo recurso Cluster Assistant, que detecta automaticamente as conexões de hardware, valida as configurações do sistema e ajusta o roteamento de rede. Como ambos os nós compartilham uma pilha de software idêntica, os ambientes já existentes em uma única unidade escalam para duas máquinas sem demandar reconfiguração de software.
Ecossistema de software e disponibilidade
A NVIDIA planeja lançar o NVIDIA Sync Model Launcher no final de outubro. O utilitário permitirá o download e a implantação em apenas um clique do Qwen3.8 27B em configurações de nó único ou multinó, disponibilizando o modelo para laptops clientes locais e configurando a ferramenta de desenvolvimento OpenCode diretamente no navegador web.
A NVIDIA também observou que fabricantes parceiras — como Acer, ASUS, Dell, HP, Lenovo, Microsoft e MSI — estão lançando este mês novos PCs com Windows equipados com a tecnologia NVIDIA RTX Spark. Ao mesmo tempo, o modelo leve de pesos abertos Qwen-Image-2.1, da Alibaba, passa a ter suporte local nas plataformas com GPUs NVIDIA RTX, DGX Spark e DGX Station para tarefas de geração e edição de imagens.
A configuração de 64 GB do DGX Spark estará disponível a partir de 23 de outubro por meio de parceiras fabricantes autorizadas.



