Huawei đẩy nhanh lộ trình Ascend: Ascend 960 ra sớm hơn, FP4 của 960PR gấp đôi kỳ vọng
Huawei details AI accelerator roadmap, pulls in next-generation Ascend NPUs by several quarters — FP4 performance of the Ascend 960PR doubles expectations

Tóm tắt nhanh
- Tại Huawei Connect, Huawei công bố đẩy lên sớm lộ trình Ascend 960: Ascend 960DT ra Q1 2027 (sớm 3 quý) và Ascend 960PR ra Q3 2027 (sớm 1 quý).
- Ascend 960DT dự kiến đạt 2 FP8 PFLOPS và 4 FP4 PFLOPS, trang bị 288 GB memory với băng thông 9.6 TB/s và interconnect 2.2 TB/s.
- Ascend 960PR cho inference đạt 8 FP4 PFLOPS (gấp đôi thông báo năm trước), cho training 2 FP8 PFLOPS, kèm 192 GB memory và 2.4 TB/s băng thông, interconnect 2.2 TB/s.
- Huawei đang chuyển từ kiến trúc SIMD sang SIMD+SIMT kết hợp xử lý vector và song song luồng để cải thiện hiệu suất trên nhiều tải AI.
- Dòng Ascend 950 (950PR cho prefill/recommendation, 950DT cho decoding/training) là những NPU đầu tiên áp dụng kiến trúc mới và đã xuất hiện trong hệ thống Atlas 950 SuperPoD đang được dùng thương mại quy mô lớn, theo công bố của Huawei.
- Huawei thừa nhận năng lực sản xuất chưa đáp ứng nhu cầu; ví dụ bản demo Atlas 950 SuperPoD tháng 7/2026 chỉ có 256 CPU và 1,024 card tăng tốc, thấp hơn cấu hình tối đa đã công bố.
- So sánh với Nvidia VR200 (Q4 2026): VR200 báo cáo 35 NVFP4 PFLOPS cho training và 50 NVFP4 PFLOPS cho inference, cùng 288 GB HBM4, cho thấy khác biệt lớn về hiệu năng thô.
- Huawei cho biết sẽ ra Ascend 970 vào 2028 và Ascend 980 vào 2029, đồng thời giới thiệu kiến trúc Peerium dựa trên UnifiedBus và mở rộng danh mục hạ tầng AI tích hợp dọc.
Tóm tắt tự động bằng AI từ bài gốc, có thể có sai sót. Hãy kiểm chứng ở bài gốc.
Trích đoạn bài gốc
Huawei's mimics Nvidia's approach to AI factories, unveils details about next-generation Ascend NPUs, Kunpeng CPUs, scale-up and scale-out connectivity solutions.Tapview chỉ hiển thị tiêu đề, trích đoạn ngắn, tóm tắt và đường dẫn tới bài gốc. Nội dung gốc thuộc bản quyền của Tom's Hardware.




