Amazon và Nvidia đã tiến gần hơn rất nhiều. Hai công ty hôm thứ Tư đã công bố mối quan hệ hợp tác mở rộng, bao gồm thỏa thuận bổ sung thêm 2 triệu chip GPU Nvidia vào các trung tâm dữ liệu của Amazon.
Những GPU này được thiết kế để đáp ứng nhu cầu tính toán nặng nề khi đào tạo và chạy các mô hình AI, bao gồm GPU Nvidia Blackwell Ultra, Rubin và Rubin Ultra. Các con chip này sẽ được chuyển đến trung tâm dữ liệu của Amazon Web Services vào năm 2027 và 2028.
Thông báo được đưa ra trong cuộc họp báo thu nhập hàng quý của Nvidia, được đưa ra chỉ 5 tháng sau khi Amazon đồng ý triển khai hơn 1 triệu GPU Nvidia trên cơ sở hạ tầng AWS bắt đầu từ năm nay. Nvidia cho biết trong một tuyên bố rằng kể từ đó, “nhu cầu đã vượt quá những mong đợi đó”.
Cả hai công ty đều không chia sẻ các điều khoản tài chính. Không rõ lợi nhuận chính xác sẽ dành cho Nvidia là bao nhiêu. Nhưng nếu xét về chi phí đơn vị GPU, thương vụ này trị giá hàng chục tỷ USD.
Thông báo này đáng chú ý không chỉ vì quy mô và tốc độ phát triển của nó mà còn vì nó vượt ra ngoài việc Amazon mua thêm chip Nvidia. Và điều đó xảy ra ngay cả khi Amazon đầu tư vào chip AI có khả năng cạnh tranh của riêng mình.
Nvidia cho biết hôm thứ Tư rằng công nghệ của họ, bao gồm phần cứng mạng kết nối hàng nghìn GPU vào một hệ thống, cũng như các mô hình mở, CPU, phần mềm xử lý dữ liệu và nền tảng robot, cũng sẽ được tích hợp trên AWS.
Các công ty cho biết “nhu cầu ngày càng tăng” từ các công ty khởi nghiệp, doanh nghiệp, phòng thí nghiệm AI và thậm chí cả chính phủ đã ảnh hưởng đến quyết định hợp tác chặt chẽ hơn.
Mối quan hệ hợp tác mở rộng diễn ra khi Amazon tăng cường nỗ lực phát triển chip AI của riêng mình – đặc biệt là với CPU, là bộ xử lý có mục đích chung ở trung tâm của máy chủ.
Amazon đã và đang xây dựng chip của riêng mình để giảm bớt sự phụ thuộc vào Nvidia và thậm chí cạnh tranh với gã khổng lồ chip. Giám đốc AI của Amazon, Peter DeSantis, cho biết AWS đang đàm phán để bán chip Trainium – giải pháp thay thế trực tiếp cho chip H100 hoặc Blackwell của Nvidia cho khối lượng công việc deep learning – cho các công ty khác để sử dụng trong trung tâm dữ liệu. CPU Graviton do Arm sản xuất của Amazon cũng được coi là thách thức đối với các chip máy chủ truyền thống của Intel và AMD.
Amazon cho biết hoạt động kinh doanh chip tùy chỉnh của họ đang phát triển, lưu ý trong cuộc báo cáo thu nhập gần đây nhất rằng họ đã vượt qua tỷ lệ doanh thu hàng năm là 25 tỷ USD, được thúc đẩy bởi tổng cam kết 225 tỷ USD từ các phòng thí nghiệm AI như Anthropic và OpenAI.
Tuy nhiên, có vẻ như Nvidia vẫn là GOAT trong thế giới chip AI.
Với 2 triệu chip GPU mà Amazon đang bổ sung vào AWS bắt đầu từ quý 3, Nvidia cũng có kế hoạch gửi một số lượng CPU Vera không xác định, “một số được tích hợp với Rubin, số khác độc lập”, theo CFO Colette Kress của Nvidia.
Giám đốc điều hành Nvidia Jensen Huang có kế hoạch lớn cho CPU Vera của công ty, hồi tháng 5 đã khoe rằng ông đã tìm thấy “TAM hoàn toàn mới trị giá 200 tỷ USD” cho công ty.
Ngoài AWS, Kress cho biết hôm thứ Tư rằng Nvidia kỳ vọng Vera sẽ được triển khai bởi “mọi công ty siêu quy mô, neocloud, phòng thí nghiệm AI và OEM hệ thống lớn, với các chuyến hàng đã được tiến hành cho các đối tác chính của chúng tôi”, bao gồm Oracle và SpaceXAI.
Sự hợp tác này cũng đang mở rộng sang các robot kho hàng và các dịch vụ dành cho doanh nghiệp của Amazon.
Kress cho biết Amazon có kế hoạch áp dụng toàn bộ hệ thống AI vật lý của Nvidia để cung cấp năng lượng cho đội robot của mình. Ngăn xếp bao gồm Omniverse (nền tảng mô phỏng và song sinh kỹ thuật số); Cosmos (nền tảng mô hình thế giới của nó); Isaac (nền tảng phát triển robot); và Jetson (phần cứng máy tính cho robot và AI biên). Tuần này, Nvidia cũng giới thiệu một phiên bản mới của Jetson được thiết kế như một máy tính chế tạo robot dễ tiếp cận hơn dành cho “AI cấp độ cơ bản”.
Về phía doanh nghiệp, AWS sẽ phục vụ dòng mô hình mở Nemotron của Nvidia trên Amazon Bedrock, nền tảng mô hình nền tảng được quản lý và SageMaker, dịch vụ đám mây được quản lý của Nvidia.
Nvidia cũng báo cáo hôm thứ Tư rằng họ đã ghi nhận doanh thu 96,2 tỷ USD trong quý thứ hai, vượt qua ước tính của các nhà phân tích. Doanh thu từ trung tâm dữ liệu chiếm phần lớn doanh thu của Nvidia trong quý ở mức 89 tỷ USD, tăng 117% so với một năm trước.
Nvidia cho biết họ kỳ vọng doanh thu sẽ đạt 108 tỷ USD trong quý 3, một phần trong số đó sẽ đến từ GPU Rubin thế hệ tiếp theo. Nvidia cho biết họ đã bắt đầu giao hàng sản xuất trong quý này. Các nhà đầu tư đang theo dõi doanh số bán hàng quý 3 ban đầu của Rubin để tìm những dấu hiệu cho thấy nhu cầu sẽ tiếp tục đối với thế hệ phần cứng tiếp theo của Nvidia.
Nvidia đã cam kết chi 279 tỷ USD để đảm bảo năng lực cung cấp và sản xuất cho các dự án trung tâm dữ liệu hiện tại và tương lai, tăng đáng kể so với mức 119 tỷ USD trong quý trước, khi nhà sản xuất chip này tìm cách đảm bảo năng lực bộ nhớ và sản xuất để đáp ứng nhu cầu AI trong vài năm tới. Cam kết đó bao gồm 92 tỷ USD chi tiêu dự kiến cho thời gian còn lại của năm tài chính và 87 tỷ USD khác trong năm tài chính 2028.
Huang cho biết trong cuộc gọi hôm thứ Tư: “Điều quan trọng đối với ngành là AI hiện đang làm những công việc hiệu quả và hữu ích. “AI đang tạo ra các token có lợi nhuận… Nếu chúng tôi có nhiều máy tính hơn, chúng tôi có thể tạo ra nhiều token có lợi nhuận hơn, mang lại nhiều lợi nhuận hơn cho tất cả các dịch vụ. Đây chính xác là giai đoạn mà chúng tôi đang ở, đó là lý do khiến mọi người đều nghiêng về.”
Các nhà đầu tư sẽ theo dõi xem liệu tính toán bổ sung có thực sự chuyển thành lợi nhuận bổ sung khi các công ty AI đổ hàng trăm tỷ đô la vào cơ sở hạ tầng hay không.
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.