d-Matrix bắt tay NVIDIA đưa chip suy luận Raptor XPU vào hạ tầng AI quy mô lớn
Hãng chip suy luận AI d-Matrix công bố tích hợp dòng vi xử lý Raptor XPU vào hạ tầng phần cứng của NVIDIA thông qua công nghệ kết nối NVLink Fusion và kiến trúc giá rack MGX.

Bước đi chiến lược đưa chip AI chuyên dụng vào hệ sinh thái NVIDIA
Nhà sản xuất vi xử lý suy luận AI d-Matrix vừa công bố việc áp dụng công nghệ kết nối NVLink Fusion của NVIDIA để tích hợp dòng chip thế hệ mới Raptor XPU vào nền tảng hạ tầng AI của "gã khổng lồ" bán dẫn này. Thỏa thuận giúp d-Matrix gia nhập danh sách các đối tác phần cứng ngày càng mở rộng của NVIDIA, đồng thời mở ra lộ trình ngắn nhất để thương mại hóa và triển khai các chip AI tùy biến ở quy mô trung tâm dữ liệu.
Thay vì phải tự thiết kế toàn bộ hệ thống từ đầu, d-Matrix sẽ kết nối Raptor XPU trực tiếp vào mạng lưới NVLink (hỗ trợ scale-up nội bộ) và nền tảng mạng Spectrum-X Ethernet (scale-out ngoại vi), tương thích hoàn toàn với kiến trúc máy chủ dạng rack NVIDIA MGX.
Giải bài toán hạ tầng: Rút ngắn chu kỳ triển khai từ chip tùy biến đến "nhà máy AI"
Việc phát triển thành công một bộ xử lý XPU chuyên dụng chỉ là bước đầu tiên trong cuộc đua bán dẫn AI. Để đưa các con chip này vận hành thực tế ở quy mô "nhà máy AI" (AI factory), các startup phải đối mặt với bài toán cực kỳ phức tạp: chuẩn hóa kiến trúc rack, giải pháp cấp nguồn, tản nhiệt, phần mềm điều phối và chuỗi cung ứng phần cứng khổng lồ.
Trong buổi họp báo, ông Sid Sheth, đồng sáng lập kiêm CEO của d-Matrix, nhấn mạnh: "Nhu cầu về suy luận AI đang bùng nổ, nhưng nguồn vốn, thời gian và năng lượng đều có hạn. Nhờ NVLink Fusion và kiến trúc MGX, chúng tôi có thể tích hợp dòng Raptor XPU vào một kiến trúc tản nhiệt chất lỏng đã được triển khai rộng rãi, mang lại cho khách hàng con đường nhanh hơn, ít rủi ro hơn để vận hành và mở rộng suy luận với độ trễ cực thấp".
Theo kế hoạch kỹ thuật, d-Matrix sẽ gom các vi xử lý Raptor thành miền tính toán băng thông cao, độ trễ thấp thông qua NVLink. Các giá rack này có thể hoạt động độc lập hoặc kết hợp nhịp nhàng với các hệ thống GPU của NVIDIA (như hệ thống NVIDIA Vera Rubin NVL72) phục vụ mô hình suy luận phân tách (disaggregated inference). Ngoài ra, d-Matrix dự kiến tích hợp thêm vi xử lý NVIDIA Vera CPU, card mạng ConnectX-9 SuperNICs, bộ xử lý dữ liệu BlueField-4 DPU và hệ thống mạng Spectrum-X.
Hệ sinh thái mở và xu thế đa dạng hóa phần cứng suy luận AI
Động thái mở giao tiếp NVLink Fusion cho thấy chiến lược mở rộng kiểm soát hạ tầng của NVIDIA: phần mềm và nền tảng được tích hợp dọc, nhưng hệ sinh thái phần cứng mở ngang để dung nạp thêm các vi xử lý chuyên biệt (XPU/CPU) từ bên thứ ba. Nền tảng "nhà máy AI" của NVIDIA hiện được thiết kế để vận hành linh hoạt nhiều loại tải công việc, tương thích cả những phần cứng như Groq 3 LPX, rack Vera CPU và hệ thống lưu trữ Vera BlueField-4 STX.
Chiến lược này giúp các trung tâm dữ liệu chỉ cần xây dựng một kiến trúc rack duy nhất theo chuẩn MGX là có thể gắn đồng thời GPU, CPU và các dòng XPU tùy biến mà không phải thay đổi cơ sở hạ tầng tản nhiệt hay mạng lưới. Đối với các startup bán dẫn như d-Matrix, việc "đứng trên vai người khổng lồ" giúp họ tập trung tối đa vào thiết kế kiến trúc chip xử lý, giảm thiểu rủi ro khi đưa phần cứng thương mại vào các trung tâm dữ liệu khổng lồ trên toàn cầu.

