NVIDIA เปิดเผยรายละเอียดเชิงลึกของสถาปัตยกรรม Rubin GPU รุ่นใหม่ ที่ออกแบบมาสำหรับงาน AI และดาต้าเซ็นเตอร์โดยเฉพาะ
NVIDIA ได้เปิดเผยรายละเอียดเชิงลึกของสถาปัตยกรรม Rubin GPU ซึ่งเป็นชิปเรือธงรุ่นใหม่ที่ออกแบบมาสำหรับงาน AI, HPC และดาต้าเซ็นเตอร์ขนาดใหญ่ โดยชูจุดเด่นด้านการขยายระบบประมวลผลได้ตั้งแต่ระดับเซิร์ฟเวอร์ไปจนถึงคลัสเตอร์หลายแร็ก
Rubin GPU ให้พลังประมวลผลสูงสุด 50 PFLOPS ในงาน Sparse NVFP4 พร้อมทรานซิสเตอร์มากถึง 336 พันล้านตัว, Streaming Multiprocessors (SMs) สูงสุด 224 ชุด และ 896 Tensor Cores รุ่นใหม่ รวมถึง Transformer Engine เจเนอเรชันที่ 3

ด้านหน่วยความจำ NVIDIA เลือกใช้ HBM4 ขนาด 288GB แบบ 12-High ให้แบนด์วิดท์สูงสุดถึง 22TB/s พร้อม Tensor Memory Accelerator รุ่นใหม่ที่ช่วยเพิ่มประสิทธิภาพการรับส่งข้อมูล
การเชื่อมต่อภายในระบบได้รับการอัปเกรดเป็น NVLink 6 ที่รองรับการสื่อสารระหว่าง GPU ได้สูงสุด 3,600GB/s ขณะที่ NVLink-C2C รองรับการสื่อสารระหว่าง CPU และ GPU ที่ 1,800GB/s นอกจากนี้ยังรองรับ PCI Express Gen6 Switch ที่มีแบนด์วิดท์สูงถึง 256GB/s

Rubin ยังรองรับเทคโนโลยี MIG (Multi-Instance GPU) ซึ่งช่วยแบ่ง GPU หนึ่งตัวออกเป็นหลาย Virtual GPU เพื่อเพิ่มประสิทธิภาพในการใช้งานบนระบบคลาวด์และ AI Data Center
สถาปัตยกรรม Rubin ถือเป็นอีกก้าวสำคัญของ NVIDIA ในการแข่งขันตลาด AI Accelerator รุ่นถัดไป ซึ่งจะต้องแข่งขันกับ AMD Instinct และชิป AI จากผู้ผลิตรายอื่นในตลาดระดับองค์กร
ที่มา: NVIDIA
