CLOUD & INFRA

NVIDIA เปิดตัวระบบ Vera Rubin NVL72 ทำสถิติใหม่ในผลทดสอบ MLPerf Inference v6.1

NVIDIA Blog16 Sep 2026
1 min read
Key Takeaways
  • Vera Rubin NVL72 มอบประสิทธิภาพการประมวลผล AI ที่ก้าวกระโดด พร้อมความสามารถในการขยายระบบระดับ 288 GPUs ที่รักษาประสิทธิภาพได้เกือบ 100%

ทำไมเรื่องนี้ถึงสำคัญ

ประสิทธิภาพในการประมวลผล Inference และความสามารถในการขยายระบบอย่างมีประสิทธิภาพส่งผลโดยตรงต่อต้นทุนในการให้บริการ AI (Cost per Token) ซึ่งเป็นปัจจัยหลักในการตัดสินใจสร้าง AI Factory หรือโครงสร้างพื้นฐานระดับองค์กร

NVIDIA เปิดตัวผลการทดสอบระบบ Vera Rubin NVL72 เป็นครั้งแรกในรายการ MLPerf Inference v6.1 โดยสามารถทำประสิทธิภาพในการประมวลผล AI (Inference) สูงกว่าระบบ GB300 NVL72 ถึง 3.7 เท่าในโมเดล Qwen3-VL และ 2.5 เท่าในโมเดล DeepSeek-R1 ซึ่งเป็นผลจากการพัฒนาแบบ Full-stack ร่วมกันระหว่างฮาร์ดแวร์และซอฟต์แวร์

นอกจากนี้ NVIDIA ยังโชว์ประสิทธิภาพการขยายระบบ (Scaling Efficiency) ของ GB300 NVL72 โดยการใช้งานร่วมกัน 4 แร็ค (288 GPUs) สามารถทำประสิทธิภาพได้สูงถึง 99% เมื่อเทียบกับแร็คเดี่ยว ซึ่งเป็นตัวบ่งชี้สำคัญถึงความคุ้มค่าในการลงทุนโครงสร้างพื้นฐาน AI ขนาดใหญ่ พร้อมทั้งมีการอัปเดตซอฟต์แวร์อย่างต่อเนื่องที่ช่วยเพิ่มประสิทธิภาพการทำงานได้สูงขึ้นถึง 1.6 เท่าจากเวอร์ชันก่อนหน้า

สรุปประเด็นหลัก

Vera Rubin NVL72 ให้ Throughput สูงกว่า GB300 NVL72 สูงสุด 3.7 เท่า

การขยายระบบ GB300 NVL72 จำนวน 4 แร็ค มีประสิทธิภาพการ Scaling สูงถึง 99%

ซอฟต์แวร์เวอร์ชัน 6.1 ช่วยเพิ่มประสิทธิภาพขึ้น 1.6 เท่าเมื่อเทียบกับเวอร์ชัน 6.0

นวัตกรรมและเทคโนโลยี

infrastructure

Vera Rubin NVL72 Performance

เปิดตัวประสิทธิภาพการประมวลผล AI ครั้งแรก โดยให้ผลลัพธ์สูงกว่ารุ่นก่อนหน้าอย่างชัดเจนในโมเดลสมัยใหม่อย่าง DeepSeek-R1

networking

Rack-Scale Efficiency

เทคโนโลยี NVLink เจนเนอเรชันที่ 6 ช่วยให้การเชื่อมต่อระดับแร็คมี Latency ต่ำลง 3 เท่า และขยายระบบได้เกือบเชิงเส้น

software

Continuous Software Optimization

การปรับปรุงซอฟต์แวร์อย่างต่อเนื่องผ่าน TensorRT-LLM และ vLLM ช่วยเพิ่มประสิทธิภาพโดยไม่ต้องเปลี่ยนฮาร์ดแวร์

Developer Impact
ทีมวิศวกรและผู้ให้บริการคลาวด์สามารถลดต้นทุนการประมวลผลต่อผู้ใช้ได้มากขึ้น ขณะที่นักพัฒนาโมเดลสามารถรันเวิร์กโหลด AI ขนาดใหญ่ได้ด้วยประสิทธิภาพที่สูงขึ้นอย่างชัดเจน
Keywords
#nvidia #vera rubin #mlperf #ai inference #blackwell
Original Source

อ่านข้อมูลเพิ่มเติมจากแหล่งข่าวหลัก

NVIDIA Blog