NVIDIA เปิดตัวผลการทดสอบระบบ Vera Rubin NVL72 เป็นครั้งแรกในรายการ MLPerf Inference v6.1 โดยสามารถทำประสิทธิภาพในการประมวลผล AI (Inference) สูงกว่าระบบ GB300 NVL72 ถึง 3.7 เท่าในโมเดล Qwen3-VL และ 2.5 เท่าในโมเดล DeepSeek-R1 ซึ่งเป็นผลจากการพัฒนาแบบ Full-stack ร่วมกันระหว่างฮาร์ดแวร์และซอฟต์แวร์
นอกจากนี้ NVIDIA ยังโชว์ประสิทธิภาพการขยายระบบ (Scaling Efficiency) ของ GB300 NVL72 โดยการใช้งานร่วมกัน 4 แร็ค (288 GPUs) สามารถทำประสิทธิภาพได้สูงถึง 99% เมื่อเทียบกับแร็คเดี่ยว ซึ่งเป็นตัวบ่งชี้สำคัญถึงความคุ้มค่าในการลงทุนโครงสร้างพื้นฐาน AI ขนาดใหญ่ พร้อมทั้งมีการอัปเดตซอฟต์แวร์อย่างต่อเนื่องที่ช่วยเพิ่มประสิทธิภาพการทำงานได้สูงขึ้นถึง 1.6 เท่าจากเวอร์ชันก่อนหน้า