NVLink Fusion ของ NVIDIA ถูกออกแบบมาเพื่อให้ผู้ให้บริการไฮเปอร์สเกลสามารถนำ XPU เข้าไปอยู่ในเครือข่ายเชื่อมต่อความเร็วสูงเดียวกันกับที่ขับเคลื่อน GPU ของบริษัท ทำให้คลัสเตอร์ชิปแบบผสมกลายเป็นโรงงาน AI เดียวที่ขยายได้ บริษัทนำเสนอเทคโนโลยีนี้เป็นวิธีผสานซิลิคอนที่ออกแบบเองเข้ากับโครงสร้างพื้นฐานที่พิสูจน์แล้ว แทนที่จะบังคับให้เลือกอย่างใดอย่างหนึ่ง
เครือข่ายเดียวสำหรับชิปผสม
XPU เป็นคำรวมสำหรับโปรเซสเซอร์เฉพาะทางที่ไม่ใช่ CPU หรือ GPU เช่น ตัวเร่งการอนุมานหรือ ASIC ที่กำหนดเอง NVLink ซึ่งเป็นอินเทอร์คอนเนกต์แบนด์วิธสูงของ NVIDIA เชื่อมต่อ GPU ของตัวเองเป็นคลัสเตอร์แน่นหนามานาน Fusion ขยายเครือข่ายเดียวกันนี้ไปยัง XPU ทำให้ไฮเปอร์สเกลเลอร์สามารถเชื่อมต่อซิลิคอนของตัวเองเข้ากับฮาร์ดแวร์ NVIDIA และจัดการทั้งระบบเป็นพูลคอมพิวติ้งเดียว
เรื่องนี้สำคัญเพราะการสร้างเครือข่ายแยกสำหรับชิปเฉพาะทางไม่กี่ตัวมีค่าใช้จ่ายสูงและช้า ด้วย Fusion อินเทอร์คอนเนกต์ที่มีอยู่แล้วจะรองรับการรับส่งข้อมูลของ XPU ด้วย ผลลัพธ์ที่ได้คือ บริษัทสามารถเพิ่มชิปที่กำหนดเองสำหรับงานเฉพาะอย่างหนึ่งได้โดยไม่ต้องออกแบบเครือข่ายศูนย์ข้อมูลใหม่ทั้งหมด
ทำไมไฮเปอร์สเกลเลอร์ถึงต้องการสิ่งนี้
ไฮเปอร์สเกลเลอร์เริ่มออกแบบซิลิคอนของตัวเองสำหรับงาน AI ที่พวกเขารู้จักดีมากขึ้น แต่ชิปเหล่านั้นแทบไม่เคยทำงานเดี่ยวๆ พวกมันอยู่ในศูนย์ข้อมูลที่เต็มไปด้วยฮาร์ดแวร์จากผู้ขายรายอื่น วิธีเชื่อมต่อแบบเดิมต้องใช้สวิตช์เพิ่ม สายเคเบิลมากขึ้น และปัญหาการดำเนินงานอีกชุดหนึ่ง
NVLink Fusion เปลี่ยนสมการนี้ มันให้เลเยอร์เครือข่ายทั่วไปที่พิสูจน์แล้วแก่ไฮเปอร์สเกลเลอร์ ซึ่งครอบคลุมทั้งฝูงบินของพวกเขา บริษัทที่อยู่เบื้องหลังกล่าวว่าสิ่งนี้ช่วยให้ลูกค้าผสานความเชี่ยวชาญเข้ากับโครงสร้างพื้นฐานที่พิสูจน์แล้ว หมายความว่าพวกเขาได้ประโยชน์ด้านต้นทุนและประสิทธิภาพจากซิลิคอนของตัวเองโดยไม่ต้องเสียความน่าเชื่อถือของอินเทอร์คอนเนกต์ที่เติบโตเต็มที่
พิมพ์เขียวโรงงาน AI
การประกาศครั้งนี้สอดคล้องกับการผลักดันในวงกว้างสู่สิ่งที่บริษัทเรียกว่าโรงงาน AI ซึ่งเป็นศูนย์ข้อมูลขนาดใหญ่ที่สร้างขึ้นรอบการเคลื่อนย้ายข้อมูลปริมาณมากผ่าน GPU และตัวเร่งอื่นๆ สิ่งเหล่านี้ไม่ใช่ฟาร์มเซิร์ฟเวอร์ธรรมดา พวกมันถูกออกแบบตั้งแต่ต้นเพื่อการฝึกและรันโมเดล AI โดยมีอินเทอร์คอนเนกต์เป็นกระดูกสันหลัง
NVLink Fusion ทำให้กระดูกสันหลังนี้เปิดกว้างมากขึ้น มันเป็นวิธีให้พื้นที่โรงงานรองรับทั้งการ์ด NVIDIA มาตรฐานและ XPU เฉพาะทาง โดยไม่บังคับให้ผู้ดำเนินการรันสิ่งอำนวยความสะดวกแยกสองแห่ง สำหรับไฮเปอร์สเกลเลอร์ นั่นอาจหมายถึงความแตกต่างระหว่างการสร้างไซต์ใหม่ทั้งหมดกับการเพิ่มเซิร์ฟเวอร์เพียงแถวเดียว
การทดสอบจริงจะเกิดขึ้นเมื่อมีคนตั้งคลัสเตอร์ผสมกับ NVLink Fusion และทำให้มันทำงานในระดับใหญ่ นั่นคือเวลาที่คำสัญญาจะเป็นจริงหรือไม่ จนกว่าจะถึงตอนนั้น มันเป็นเพียงกระดาษ หรือการออกแบบชิป ที่รอคอยศูนย์ข้อมูล


