Huawei Atlas 960E giảm 550 kW, nhưng hiệu năng vẫn do hãng tự công bố

Huawei công bố Atlas 960E SuperPoD tại HUAWEI CONNECT 2026 ở Thượng Hải ngày 17/9. Theo thông báo kỹ thuật của Huawei, hệ thống dùng UnifiedBus và động cơ quang Hi-ONE để kết nối tối đa 4.096 NPU; hãng tuyên bố thiết kế này giảm hơn 550 kW so với phương án dùng 48.000 mô-đun quang 800G.
Bản tin ngày 17/9 của AP xác nhận Huawei giới thiệu cụm Atlas 960 tại hội nghị ở Thượng Hải, trong bối cảnh Trung Quốc đẩy mạnh chip AI nội địa và Huawei cạnh tranh với Nvidia. Tuy nhiên, con số điện năng, năng lực tính toán và độ tin cậy của Atlas 960E hiện vẫn là thông số do Huawei công bố, chưa phải kết quả từ một phép thử độc lập.
Atlas 960E thay đổi phần liên kết quang
Điểm đáng chú ý của Atlas 960E nằm ở cách kết nối hàng nghìn bộ tăng tốc. NPO, viết tắt của Near-Packaged Optics, đưa thành phần quang đến gần gói chuyển mạch hoặc tính toán hơn so với mô-đun quang cắm rời. Hi-ONE đảm nhiệm liên kết quang, còn UnifiedBus cho phép các nút truy cập bộ nhớ theo một không gian địa chỉ thống nhất.
Huawei cho biết một Atlas 960E có thể mở rộng tới 4.096 NPU, đạt công suất tính toán đỉnh 8 EFLOPS ở FP8 và 16 EFLOPS ở FP4. Hệ thống dùng 5.500 động cơ Hi-ONE có năng lực truyền 7,2 Tbit/s mỗi động cơ, kiến trúc trực giao và làm mát hoàn toàn bằng chất lỏng.
Mốc 550 kW không phải mức tiêu thụ điện toàn hệ thống. Đây là khoản Huawei nói có thể cắt giảm khi 5.500 Hi-ONE thay thế 48.000 mô-đun quang 800G mà hãng cho rằng sẽ cần trong phương án truyền thống. Huawei đồng thời tuyên bố thời gian vận hành không lỗi tăng gấp đôi và độ sẵn sàng đạt 99,8%, nhưng chưa công bố điều kiện tải, thời gian quan sát hay dữ liệu vận hành tại khách hàng để bên ngoài kiểm tra các kết quả này.
Đâu là thông số, đâu là bằng chứng hiệu năng
- Đã được công bố: Atlas 960E là thiết kế SuperPoD dùng UnifiedBus, Hi-ONE và NPO, có quy mô tối đa 4.096 NPU.
- Là tuyên bố của Huawei: năng lực tính toán đỉnh 8 EFLOPS FP8 và 16 EFLOPS FP4, giảm hơn 550 kW, tăng gấp đôi thời gian vận hành không lỗi và đạt độ sẵn sàng 99,8%.
- Chưa có phép đo độc lập: tốc độ huấn luyện hoặc suy luận trên mô hình cụ thể, hiệu suất mở rộng ở quy mô tối đa, điện năng dưới tải duy trì và độ tin cậy ngoài hiện trường.
- Chưa rõ về thương mại: giá bán, lịch giao hệ thống hoàn chỉnh, sản lượng, khách hàng triển khai và phạm vi thị trường có thể mua.
EFLOPS đo năng lực tính toán đỉnh ở một định dạng số nhất định; nó không tự động cho biết thời gian huấn luyện mô hình hay số token suy luận mỗi giây. Hiệu năng hữu ích còn phụ thuộc vào dung lượng và băng thông bộ nhớ, giao tiếp tập thể giữa các NPU, phần mềm, mức tối ưu của mô hình và thời gian xử lý lỗi.
Vì vậy, Atlas 960E hiện cho thấy quy mô thiết kế và hướng kiến trúc, chưa chứng minh được hiệu năng ứng dụng. Một so sánh công bằng với hệ thống Nvidia cũng cần cùng mô hình, độ chính xác số, phần mềm, mức tải và phạm vi điện năng được đo; những điều kiện đó chưa xuất hiện trong tài liệu công khai.
Vì sao giảm mô-đun quang có thể tiết kiệm điện
Trong cụm AI lớn, mỗi mô-đun quang đều tiêu thụ điện, phát nhiệt, chiếm không gian và tạo thêm một điểm có thể hỏng. Nếu NPO thực hiện cùng nhiệm vụ kết nối với ít thành phần rời hơn, tải dành cho nguồn điện và làm mát có thể giảm, trong khi số linh kiện cần bảo trì cũng ít đi.
Nhưng số mô-đun giảm mạnh không có nghĩa điện năng hoặc tỷ lệ lỗi của toàn hệ thống sẽ giảm theo đúng cùng tỷ lệ. Việc đặt quang học gần các linh kiện công suất cao làm tăng yêu cầu về đóng gói, kiểm soát nhiệt, khả năng sửa chữa và tỷ lệ sản xuất đạt chuẩn. Do đó, khoản giảm hơn 550 kW chỉ có thể được đánh giá đầy đủ khi Huawei công bố cấu hình đối chứng, tải thử và ranh giới thiết bị được tính.
Ý nghĩa cạnh tranh của Atlas 960E nằm ở cách Huawei xử lý nút thắt liên kết ở cấp hệ thống thay vì chỉ đối chiếu một NPU với một GPU. Khi hàng nghìn bộ tăng tốc phải vận hành như một máy tính thống nhất, băng thông, độ trễ, phần mềm phân tán và khả năng phục hồi lỗi quyết định bao nhiêu năng lực tính toán đỉnh thực sự biến thành hiệu năng cho khách hàng.
Atlas 960E khác Atlas 960 từng nằm trong lộ trình
Tên gọi gần nhau không đồng nghĩa hai hệ thống có cùng cấu hình. Atlas 960 trong lộ trình trước đây được mô tả với tối đa 15.488 NPU, còn Atlas 960E mới là thiết kế NPO tối đa 4.096 NPU. Vì vậy, không thể chuyển các thông số từng gắn với Atlas 960 sang phiên bản 960E chỉ dựa trên tên sản phẩm.
Phân tích của AI Stack Current xác định Atlas 960E là cột mốc kiến trúc đang ở giai đoạn thử nghiệm, không phải bằng chứng về triển khai sản xuất rộng rãi. Trang này cũng tách việc công bố thiết kế, thử nghiệm hệ thống, khả dụng của chip và giao hàng thương mại thành những trạng thái khác nhau.
Điều còn thiếu sau thông báo ngày 17/9 là benchmark huấn luyện và suy luận có nêu rõ mô hình cùng phần mềm, phép đo công suất toàn hệ thống dưới tải duy trì, hiệu suất mở rộng khi tăng số NPU và dữ liệu độ tin cậy tại khách hàng. Cho đến khi các kết quả đó xuất hiện, khoản tiết kiệm điện cùng các mức EFLOPS của Atlas 960E nên được hiểu là tuyên bố kỹ thuật của Huawei, không phải hiệu năng đã được kiểm chứng độc lập.
Đọc thêm:
Đăng ký bản tin
Nhận tin Web3, AI và tiền mã hóa mới nhất ngay trong hộp thư.