AI RACE— Cuộc đua AI
Doanh nghiệp

NVIDIA và CoreWeave ra mắt hạ tầng “Agentic AI” mới: Vera Rubin NVL72 và CPU Vera trên đám mây

CoreWeave đưa hệ thống NVIDIA Vera Rubin NVL72 và CPU Vera vào sản xuất, cho phép tăng gấp 4,8 tốc độ token và hơn 3 lần tốc độ khởi động sandbox cho AI tác nhân.

22:00 30/09/2026
NVIDIA và CoreWeave ra mắt hạ tầng “Agentic AI” mới: Vera Rubin NVL72 và CPU Vera trên đám mây

Sự kiện chính

Vào ngày 30‑9‑2026, CoreWeave công bố chính thức cung cấp trên nền tảng đám mây của mình hai sản phẩm phần cứng mới của NVIDIA: hệ thống máy chủ Vera Rubin NVL72 (kèm mạng Spectrum‑X 102.4 Tbit/s) và CPU Vera – bộ vi xử lý đầu tiên được thiết kế dành riêng cho các AI tác nhân (agentic AI). Đây là lần đầu tiên một nhà cung cấp đám mây công khai đưa Vera Rubin vào môi trường sản xuất.

Chi tiết kỹ thuật và kết quả thực tiễn

  • Vera Rubin NVL72: Được triển khai trong các rack sản xuất đầu tiên tại CoreWeave, hệ thống này đã được khách hàng đầu tiên – Cognition, phòng thí nghiệm AI phát triển phần mềm Devin – thử nghiệm. So sánh với nền tảng GB200 NVL72, Vera Rubin cho thấy tăng lên tới 4,8 × tổng lượng token xử lý trong các khối tải inference SWE‑2, đồng nghĩa với việc tạo mã nhanh hơn và khả năng suy luận đa bước linh hoạt hơn.
  • CPU Vera: Mỗi rack chứa 128 CPU, tổng cộng 11 264 lõi, cho phép hơn 11 000 môi trường sandbox độc lập chạy đồng thời, mỗi môi trường chỉ dùng một lõi. Khi chạy trên CoreWeave Sandboxes, thời gian khởi động sandbox nhanh hơn hơn 3 ×, và trên bộ benchmark Terminal‑Bench, hiệu năng chung tăng 1,7 × so với các CPU truyền thống.
  • Mạng Spectrum‑X: Kết nối Ethernet 102.4 Tbit/s giúp duy trì độ trễ thấp cho giao tiếp giữa các agent, đồng thời BlueField‑4 DPU bảo vệ tính bảo mật và hiệu suất truyền dữ liệu.
  • CoreWeave Forge: Nền tảng tích hợp Weights & Biases, OpenPipe và dự án notebook mã nguồn mở marimo, cho phép vòng lặp “train‑produce‑retrain” liền mạch. Các tính năng mới bao gồm:
  • CoreWeave ARIA (đã ra mắt rộng rãi) – hỗ trợ tự động đề xuất thí nghiệm, phân tích kết quả, và tạo pull‑request trên GitHub.
  • CoreWeave Agent Lens – công cụ quan sát và cải thiện AI tác nhân, giảm lỗi 20 % và chi phí sửa lỗi một nửa.
  • CoreWeave Sandboxes – môi trường thực thi CPU/GPU cô lập, có thể chạy dưới dạng serverless hoặc trên hạ tầng hiện có, hỗ trợ RL, tool‑call và đánh giá mô hình.
  • Đối tác và khách hàng: Ngoài Cognition, các công ty như Canva, Capital One và MasterClass đã bắt đầu triển khai Forge. NVIDIA Nemotron mở ra khả năng tùy chỉnh mô hình đa phương tiện cho quy trình tác nhân.
  • Câu nói của lãnh đạo: Ian Buck, Phó Chủ tịch HPC tại NVIDIA, nhấn mạnh “Nền tảng NVIDIA vẫn tạo giá trị qua các thế hệ; GPU V100 của chúng tôi vẫn đang chạy các khối tải khách hàng gần một thập kỷ sau khi Volta ra mắt, và Vera Rubin NVL72 tiếp tục mở rộng khả năng đó.” Silas Alberti, đồng sáng lập Cognition, cho biết “Công việc mã hoá tác nhân rất phức tạp; việc có một nền tảng đồng nhất với NVIDIA và CoreWeave đồng hành giải quyết các thách thức này quan trọng hơn bất kỳ thông số kỹ thuật nào.”

Bối cảnh và ý nghĩa rộng hơn

Sự ra mắt này đánh dấu bước tiến cuối cùng trong chuỗi hợp tác gần mười năm giữa NVIDIA và CoreWeave, khi công nghệ tính toán tăng tốc của NVIDIA được tích hợp sâu vào một đám mây chuyên dụng cho AI. Đối với ngành AI tác nhân, yêu cầu về độ trễ thấp và khả năng mở rộng đồng thời lên tới hàng ngàn môi trường cô lập đang trở thành tiêu chuẩn mới; Vera Rubin và CPU Vera đáp ứng trực tiếp nhu cầu này. Đồng thời, việc CoreWeave mở cung cấp hạ tầng này trên nền tảng đám mây giúp các doanh nghiệp không cần đầu tư vào phần cứng nội bộ vẫn có thể khai thác sức mạnh “AI factory” của NVIDIA, giảm chi phí và thời gian đưa sản phẩm AI ra thị trường. Với thành tựu liên tục đạt xếp hạng Platinum trong các cuộc thi MLPerf và phục vụ 9 trong số 10 phòng thí nghiệm AI hàng đầu, CoreWeave cùng NVIDIA đang định hình lại cách các công ty triển khai, vận hành và cải tiến các AI tác nhân trong thực tiễn.

◗ Nguồn

NVIDIA Blog30-09

Tin liên quan