DEV Community

Nokka
Nokka

Posted on AI-assisted

Huawei เปิด Atlas 960E SuperPoD ซูเปอร์คลัสเตอร์ล้านชิปที่แข่งกันที่ระบบ ไม่ใช่ชิป

Huawei เปิด Atlas 960E SuperPoD ซูเปอร์คลัสเตอร์ล้านชิปที่แข่งกันที่ระบบ ไม่ใช่ชิป

โดย Nokka (นก-กา) | 30 กันยายน 2026

บทความนี้เขียนโดย AI (โมเดล deepseek-v4.1-flash ของผู้ให้บริการ ollama-cloud) ผ่าน Hermes Agent จาก Nous Research ตรวจสอบและเรียบเรียงโดย Nokka

TL;DR

Huawei เปิดตัว Atlas 960E SuperPoD ที่งาน HUAWEI CONNECT 2026 เมื่อวันที่ 17 กันยายน เป็นซูเปอร์โหนดตัวแรกของโลกที่ใช้เทคโนโลยีออปติกแบบ NPO หนึ่งโหนดต่อ NPU ได้ถึง 4,096 ตัว ให้พลังประมวลผล 8 EFLOPS ที่ความละเอียด FP8 และขยายเป็นซูเปอร์คลัสเตอร์ 512,000 NPU และแตะหนึ่งล้านเมื่อใช้ multi-rail หัวใจของมันคือการเปลี่ยนวิธีเดินสายเชื่อมชิปทั้งระบบ

ตัวเลขของเครื่องนี้

Atlas 960E SuperPoD ใช้การออกแบบแบบออร์โธโกนัล (orthogonal)และระบายความร้อนด้วยของเหลวทั้งระบบ[1] เมื่อใช้ UnifiedBus ที่ให้การระบุที่อยู่หน่วยความจำแบบรวมได้ หนึ่งซูเปอร์โหนดจึงขยายได้ถึง 4,096 NPU ให้พลังประมวลผล 8 EFLOPS ที่ FP8 และ 16 EFLOPS ที่ FP4[1]

ตัวเลขที่ผมคิดว่าสำคัญที่สุดคือการประหยัดพลังงาน ระบบนี้ใช้ Hi-ONE จำนวน 5,500 ตัว แทนที่โมดูลออปติก 800G จำนวน 48,000 ตัวที่ระบบแบบเดิมต้องใช้เพื่อเชื่อม NPU ทั้งหมดเข้าด้วยกัน[1]

ผลคือลดการใช้พลังงานลงกว่า 550 กิโลวัตต์ เพิ่มเวลาทำงานโดยไม่เกิดข้อขัดข้องเป็นสองเท่า และได้ความพร้อมใช้งานของระบบที่ 99.8%[1]

Hi-ONE คือหัวใจของเครื่องนี้

Hi-ONE ย่อมาจาก High-density Optical-interconnect-Node Engine เป็นผลิตภัณฑ์ออปติกที่สร้างจากเทคโนโลยี near-packaged optics ของ Huawei ส่งข้อมูลได้ 7.2 เทระบิตต่อวินาทีต่อหนึ่งเอนจิน[1]

Huawei อ้างว่าเป็นผลิตภัณฑ์ NPO รายแรกที่พร้อมผลิตจำนวนมาก มีความจุสูงสุดในอุตสาหกรรม และเป็นรายเดียวที่มีแหล่งกำเนิดแสงในตัว[1]

จาก SuperPoD สู่ SuperCluster

หนึ่งซูเปอร์โหนดยังไม่ใช่เพดาน เมื่อเชื่อมหลาย Atlas 960E SuperPoD เข้าด้วยกันผ่านเครือข่าย UnifiedBus หรือ RoCE จะได้ซูเปอร์คลัสเตอร์ที่ใหญ่ขึ้น ด้วยสถาปัตยกรรม Clos แบบสองชั้นสี่ระนาบ ซูเปอร์คลัสเตอร์เชื่อมได้ถึง 512,000 NPU[1]

และเมื่อใช้โทโพโลยีแบบ multi-rail คลัสเตอร์นี้รองรับได้ถึงหนึ่งล้าน NPU[1]

มิติ Atlas 960E SuperPoD SuperCluster เต็มรูปแบบ
จำนวน NPU สูงสุด 4,096 512,000 (หรือ 1 ล้านเมื่อใช้ multi-rail)
สถาปัตยกรรมเชื่อมต่อ UnifiedBus + Hi-ONE Clos สองชั้นสี่ระนาบ
พลังประมวลผล 8 EFLOPS FP8 / 16 EFLOPS FP4 ไม่เปิดเผย
จุดเด่นด้านพลังงาน ลดลงกว่า 550 กิโลวัตต์ ไม่เปิดเผย

Huawei ยังเอาแนวคิดซูเปอร์โหนดไปใช้กับระบบคอมพิวต์ทั่วไปด้วย ผลิตภัณฑ์ชื่อ TaiShan 950 SuperPoD ใช้เครือข่ายออปติก UnifiedBus รองรับได้ถึง 4,096 โหนด พร้อมพูลหน่วยความจำรวมขนาด 256 เทระไบต์[1]

บริษัทยังเปิด OceanStor M900 คลัสเตอร์จัดเก็บหน่วยความจำบริบทที่ให้แคช KV ระดับเพตะไบต์สำหรับชั้น L3.5[1]

ทำไมต้องแข่งที่ระบบ ไม่ใช่ที่ชิป

Huawei ประกาศชัดว่ากลยุทธ์ AI ของบริษัทวางกำลังประมวลผลเป็นแกนกลาง และโฟกัสที่การทำฮาร์ดแวร์ให้เกิดรายได้[1] แต่เหตุผลที่บริษัทลงทุนกับซูเปอร์โหนดมากขนาดนี้มาจากข้อจำกัดที่รู้กันดี

เมื่อโมเดลพื้นฐานเข้าใกล้ระดับ 10 ล้านล้านพารามิเตอร์ การเอาชิปเดี่ยวที่แรงที่สุดมาต่อกันเฉย ๆ ไม่พอ เพราะคอขวดย้ายไปอยู่ที่การสื่อสารระหว่างชิปและหน่วยความจำ

การเชื่อมชิปหลายพันตัวให้ทำงานเหมือนเครื่องเดียวจึงเป็นปัญหาสำคัญกว่าเลข TFLOPS ของชิปแต่ละตัว แนวทางของ Huawei คือวางทุกองค์ประกอบในคลัสเตอร์ไว้ใต้โปรโตคอลเดียวที่มีการเชื่อมต่อแบบเพียร์ทูเพียร์ รองรับการเข้าถึงหน่วยความจำข้ามเซิร์ฟเวอร์ และใช้ทองแดงระยะสั้นคู่กับออปติกระยะไกล[1]

แผนชิปและระบบนิเวศ

ด้านชิป Huawei เร่งแผน Ascend ให้เร็วขึ้น โดยเลื่อน Ascend 960DT ซึ่งเป็นรุ่นสืบทอดของ Ascend 950 มาเป็นไตรมาสแรกของปี 2027 เร็วขึ้นสามไตรมาส[2] ส่วน Ascend 970 และ 980 จะตามมาในปี 2028 และ 2029[2]

ในคีย์โน้ตของงานเดียวกัน David Wang ระบุว่าพอร์ตโฟลิโอชิป 11 ตัวที่ขับด้วย UnifiedBus จะเป็นฐานให้ทั้งซูเปอร์โหนดและซูเปอร์คลัสเตอร์[3]

อีกเรื่องที่ควรให้ความสำคัญคือ CANN ซึ่งเป็นสแตกซอฟต์แวร์ของ Ascend ได้เข้าสู่การพัฒนาระบบโอเพนซอร์สที่ขับเคลื่อนโดยชุมชนอย่างต่อเนื่องแล้ว[1]

David Wang รองประธานคณะกรรมการและประธานหมุนเวียนของ Huawei กล่าวในคีย์โน้ตว่า Huawei มุ่งสร้างโครงสร้างพื้นฐาน AI และเปิดทั้งซอฟต์แวร์และระบบเพื่อสร้างระบบนิเวศการประมวลผล พร้อมสนับสนุนการเทรนโมเดลพื้นฐานหลักบน Ascend[1]

การเปิดสแตกซอฟต์แวร์เป็นสัญญาณที่คนทำงานสายเทคนิคควรจับตา เพราะที่ผ่านมาข้อจำกัดใหญ่ของชิป Huawei ไม่ใช่ความแรง แต่เป็นความยากในการย้ายงานที่เขียนมาสำหรับ CUDA ไปรันบน Ascend

อ่านข่าวนี้ให้ครบ

ข้อควรระวังคือตัวเลขทั้งหมดมาจากการประกาศของ Huawei เอง ยังไม่มีผลทดสอบอิสระที่ยืนยันว่า 8 EFLOPS ที่ FP8 หรือความพร้อมใช้งาน 99.8% เป็นอย่างไรในงานจริง

โดยยังไม่มีลูกค้า Atlas 960E รายใดเปิดเผยชื่อ ส่วนลูกค้าที่สั่งชิปตระกูล Ascend ไปแล้วอย่าง DeepSeek ซึ่งสั่ง Ascend 950DT รุ่นก่อนหน้าไป 160,000 ตัว[5] สิ่งที่ต้องจับตาคือผลการใช้งานจริงของลูกค้ารายนี้ในอีก 12 เดือนข้างหน้า

การขยายสู่ระดับล้าน NPU ถูกวิเคราะห์ว่าเป็นการวางตำแหน่งของ Huawei ในฐานะผู้ขายระบบทั้งชุด ไม่ใช่ผู้ขายชิป[4]

ภาพที่ชัดแล้วคือจีนไม่ได้แข่งที่การทำชิปที่แรงกว่าอีกต่อไป แต่แข่งที่การจัดระบบให้ชิปหลายแสนตัวทำงานเป็นเครื่องเดียว และนั่นเป็นปัญหาวิศวกรรมคนละแบบกับที่ Nvidia กำลังแก้อยู่ แม้ปลายทางจะคล้ายกัน

ถ้าคุณเป็นคนดูแลโครงสร้างพื้นฐาน ลองเปรียบเทียบว่าโจทย์ของคุณคือชิปที่แรงที่สุดต่อหน่วย หรือระบบที่ขยายได้มากที่สุดต่อวัตต์ เพราะสองโจทย์นี้นำไปสู่การเลือกต่างกัน และติดตามผลจริงจากลูกค้าอย่าง DeepSeek ในอีก 12 เดือน

REF

[1] Huawei, "Huawei Launches the World's First NPO-based SuperPoD: the Atlas 960E SuperPoD" (แถลง 17 ก.ย. 2026 ที่ HUAWEI CONNECT เซี่ยงไฮ้: 4,096 NPU ต่อโหนด · 8 EFLOPS FP8 / 16 EFLOPS FP4 · Hi-ONE 5,500 ตัวแทนโมดูล 800G 48,000 ตัว · ลดไฟกว่า 550 กิโลวัตต์ · availability 99.8% · SuperCluster 512,000 NPU และระดับ 1 ล้าน NPU · TaiShan 950 · OceanStor M900 · CANN โอเพนซอร์ส · คำกล่าว David Wang), 17 กันยายน 2026. https://www.huawei.com/en/news/2026/9/hc-ascend960-supernode

[2] Reuters, "China's Huawei says AI chip demand outstrips supply as it steps up Nvidia challenge" (เร่งแผน: Ascend 960DT เลื่อนมาไตรมาส 1 ปี 2027 เร็วขึ้นสามไตรมาส · 970/980 ในปี 2028/2029), กันยายน 2026. https://www.reuters.com/world/asia-pacific/chinas-huawei-launch-two-new-ai-chips-2027-2026-09-17

[3] Huawei, "Advancing the Agentic World, Building a Solid Silicon Foundation" (คีย์โน้ตของ David Wang · พอร์ตโฟลิโอ 11 ชิปที่ขับด้วย UnifiedBus สำหรับซูเปอร์โหนดและซูเปอร์คลัสเตอร์), 17 กันยายน 2026. https://www.huawei.com/en/news/2026/9/hc-wang-keynote

[4] Techzine, "Huawei Atlas 960E scales up to a SuperCluster of a million NPUs" (บทวิเคราะห์การวางตำแหน่งผู้ขายระบบทั้งชุด ไม่ใช่ผู้ขายชิป), กันยายน 2026. https://www.techzine.eu/blogs/infrastructure/144385/huawei-atlas-960e-scales-up-to-a-supercluster-of-a-million-npus

[5] Bloomberg, "DeepSeek Plans Big Huawei AI Chip Order to Power New Data Center" (คำสั่งซื้อ Ascend 950DT 160,000 ตัว · ศูนย์ข้อมูล 1GW · 4 กันยายน 2026), 4 กันยายน 2026. https://www.bloomberg.com/news/articles/2026-09-04/deepseek-plans-big-huawei-ai-chip-order-to-power-new-data-center

Top comments (0)