AWS đặt thêm 2 triệu GPU Nvidia: công suất mới chỉ đến từ 2027

Ngày 26/8/2026, AWS và Nvidia công bố kế hoạch triển khai thêm 2 triệu GPU Nvidia trên hạ tầng toàn cầu của AWS trong giai đoạn 2027–2028. Thông báo được phát từ Seattle và Santa Clara, nhưng chưa có nghĩa số chip này đã được lắp đặt hoặc sẵn sàng cho khách hàng thuê.
Đây là phần bổ sung cho kế hoạch hơn 1 triệu GPU bắt đầu triển khai từ năm 2026. Tổng quy mô được AWS công bố vì thế vượt 3 triệu GPU qua hai cam kết, song hai công ty chưa nêu giá trị thỏa thuận, số lượng phân bổ cho từng năm hay lịch cung cấp tại từng khu vực AWS.
Hai triệu GPU là công suất tương lai

Thông cáo của AWS và Nvidia xác định rõ 2 triệu GPU là số lượng bổ sung, dự kiến được triển khai trong năm 2027 và 2028 trên hạ tầng AWS toàn cầu, bao gồm các cơ sở được hai bên gọi là nhà máy AI. Danh mục dự kiến gồm Blackwell Ultra, Rubin và Rubin Ultra, phục vụ các tải AI tác tử, nghiên cứu khoa học, tự động hóa doanh nghiệp và AI vật lý.
Từ “triển khai” ở đây mô tả một kế hoạch trong tương lai, không xác nhận rằng AWS đã nhận đủ phần cứng, hoàn tất trung tâm dữ liệu hay mở các phiên bản EC2 tương ứng. Thông báo cũng không chia 2 triệu GPU thành chỉ tiêu riêng cho năm 2027 và 2028, nên chưa thể xác định công suất sẽ tăng nhanh đến đâu trong từng giai đoạn.
Vì vậy, con số trong tiêu đề phản ánh quy mô AWS cam kết bổ sung, không phải năng lực có thể sử dụng ngay. Đối với khách hàng đám mây, khả năng tiếp cận thực tế còn phụ thuộc vào khu vực, loại phiên bản, hạn ngạch, phương thức đặt trước và thời điểm thương mại hóa mà AWS chưa công bố.
Hơn ba triệu GPU thuộc hai cam kết khác nhau

Mốc đầu tiên xuất hiện tại Nvidia GTC 2026, khi AWS nêu kế hoạch bổ sung hơn 1 triệu GPU Nvidia và bắt đầu triển khai trong năm 2026. Mốc thứ hai là 2 triệu GPU bổ sung cho giai đoạn 2027–2028. Cộng số lượng cho thấy kế hoạch đã công bố vượt 3 triệu GPU, nhưng không đồng nghĩa toàn bộ số chip này sẽ cùng hoạt động trong năm 2026.
Tường thuật của TechCrunch phân biệt hai mốc triển khai và cho biết thông báo mới xuất hiện khoảng năm tháng sau cam kết hơn 1 triệu GPU. Bài báo cũng ghi nhận Blackwell Ultra, Rubin và Rubin Ultra sẽ được đưa vào các trung tâm dữ liệu AWS trong năm 2027 và 2028, còn điều khoản tài chính không được hai công ty công bố.
Cụm từ “gấp ba đơn hàng” trong tiêu đề của TechCrunch là cách so sánh tổng quy mô mới với mốc ban đầu. Thông tin công khai chưa cho thấy một đơn đặt hàng duy nhất gồm hơn 3 triệu GPU, cũng chưa nêu cơ cấu số lượng giữa ba dòng chip. Cách mô tả chính xác hơn là AWS có hai kế hoạch nối tiếp nhau: hơn 1 triệu GPU bắt đầu từ năm 2026 và thêm 2 triệu GPU trong hai năm tiếp theo.
Thỏa thuận còn bao gồm CPU, bộ nhớ và mạng

Phạm vi hợp tác mở rộng vượt ra ngoài việc tăng số GPU. AWS và Nvidia đang làm việc để đưa hạ tầng sử dụng CPU Vera lên AWS, tạo thêm lựa chọn cho những tải AI tác tử cần xử lý mã, dùng công cụ, phân tích dữ liệu và điều phối bên cạnh năng lực tăng tốc. Chưa có số lượng CPU Vera, ngày phát hành dịch vụ hoặc cấu hình phiên bản cụ thể.
Annapurna Labs của Amazon cũng sẽ mở rộng việc sử dụng NVLink Fusion để làm việc với công nghệ bộ nhớ băng thông cao tùy biến NVHBM của Nvidia. Sự kết hợp này được định hướng để tích hợp chip Trainium và GPU trong cùng kiến trúc quy mô tủ rack. Hai công ty đồng thời hợp tác về mạng Nvidia Spectrum cho các cụm huấn luyện lớn, trong khi các phiên bản EC2 dựa trên GPU Nvidia và Trainium tiếp tục sử dụng AWS Nitro System cùng Elastic Fabric Adapter.
Các hạng mục khác gồm mô hình Nemotron trên Amazon Bedrock và SageMaker, xử lý dữ liệu bằng cuDF, lập chỉ mục vector bằng cuVS và nền tảng AI vật lý cho Amazon Robotics. Tuy nhiên, khung thời gian 2027–2028 chỉ được gắn rõ với 2 triệu GPU bổ sung; không có căn cứ để mặc định mọi thành phần CPU, mạng, bộ nhớ và phần mềm đều tuân theo cùng một lịch.
Giá trị thỏa thuận và lịch cung cấp vẫn để ngỏ
Associated Press độc lập ghi nhận AWS và Nvidia đã công bố kế hoạch triển khai thêm 2 triệu GPU trong bối cảnh nhu cầu chip AI và chi tiêu hạ tầng của các nhà cung cấp đám mây tiếp tục tăng. Bản tin này xác nhận quy mô bổ sung, nhưng không cung cấp giá trị hợp đồng hoặc lịch phân bổ chi tiết.
Không thể suy ra đáng tin cậy tổng chi phí bằng cách nhân một mức giá GPU tham khảo với 2 triệu. Một hệ thống vận hành thực tế còn gồm máy chủ, CPU, bộ nhớ, mạng, lưu trữ, nguồn điện, làm mát, phần mềm và các điều khoản thương mại; hơn nữa, cơ cấu giữa Blackwell Ultra, Rubin và Rubin Ultra chưa được công bố.
Những dữ kiện đã xác nhận hiện dừng ở quy mô, phạm vi toàn cầu và cửa sổ triển khai 2027–2028. Các mốc tiếp theo cần chờ gồm số lượng cho từng năm, khu vực đặt máy, phiên bản EC2, giá thuê, hạn ngạch và khả năng đặt trước. Cho đến khi AWS công bố các dữ liệu đó, phần 2 triệu GPU vẫn phải được hiểu là công suất tương lai bắt đầu từ năm 2027, tách biệt với đợt hơn 1 triệu GPU khởi động trong năm 2026.
Đọc thêm:
Đăng ký bản tin
Nhận tin Web3, AI và tiền mã hóa mới nhất ngay trong hộp thư.