AWS dan NVIDIA merancang untuk menggunakan dua juta lagi GPUmerentasi infrastruktur AWS sepanjang tahun 2027 dan 2028. Pelaksanaan yang dirancang akan merangkumi NVIDIA Blackwell Ultra, Rubin dan Rubin Ultra GPUs untuk latihan AI, inferens, pengkomputeran saintifik, automasi perusahaan dan beban kerja AI fizikal.
Pengumuman itu menggambarkan komitmen infrastruktur masa depan dan bukannya dua juta yang tersedia serta-merta GPUs. Ia mengikuti rancangan AWS terdahulu untuk menambah lebih daripada satu juta NVIDIA GPUbermula pada tahun 2026.
Pelan Infrastruktur Diperluas AWS dan NVIDIA
AWS dan NVIDIA mengumumkan perkongsian yang diperluas pada 26 Ogos 2026. Kedua-dua syarikat itu berkata tambahan itu GPUakan digunakan merentasi infrastruktur global AWS, termasuk sistem yang digambarkan sebagai kilang AI.
Perkongsian ini merangkumi lebih daripada GPU kapasiti. AWS dan NVIDIA juga merancang untuk:
- Memperkenalkan infrastruktur berasaskan NVIDIA CPU Vera.
- Panjangkan NVIDIA NVLink Fusion dengan memori jalur lebar tinggi tersuai.
- Mengintegrasikan NVIDIA GPUs dengan rangkaian AWS Nitro dan Elastic Fabric Adapter.
- Teruskan menyediakan NVIDIA Model Nemotron melalui Amazon Bedrock dan SageMaker.
- Mempercepatkan pemprosesan data dan pengindeksan vektor melalui Amazon EMR dan OpenSearch.
- Gunakan platform AI fizikal NVIDIA untuk beban kerja Amazon Robotics.
Syarikat-syarikat tersebut juga merancang untuk membina infrastruktur AI untuk kerajaan AS. Ini termasuk 100,000 GPUpada sistem AWS selamat yang bertujuan untuk beban kerja keselamatan persekutuan dan negara pada Tahap Impak 6 dan ke atas.
Matt Garman, Ketua Pegawai Eksekutif AWS, berkata pelanggan “mahukan kebebasan untuk memilih alatan terbaik untuk beban kerja AI mereka”. AWS bersama dan NVIDIA pengumuman membentangkan pengembangan ini sebagai respons kepada organisasi yang memindahkan projek AI daripada projek rintis kepada pengeluaran.
Apakah Bukti yang Menunjukkan Permintaan Infrastruktur AI Sedang Berkembang?
Amazon dan NVIDIA melaporkan pertumbuhan yang ketara dalam perniagaan awan dan pusat data mereka sebelum mengumumkan tambahan GPU penyebaran.
Amazon melaporkan bahawa AWS menjana jualan sebanyak $42.2 bilion pada suku kedua 2026, peningkatan sebanyak 37% berbanding tempoh yang sama pada tahun 2025. Amazon juga berkata perniagaan AI AWSnya telah melebihi kadar larian pendapatan tahunan sebanyak $25 bilion dan berkembang pada peratusan tiga digit tahun ke tahun.
Pembelian hartanah dan peralatan Amazon meningkat sebanyak $66.1 bilion dalam tempoh 12 bulan berikutnya. Syarikat itu mengaitkan peningkatan itu terutamanya kepada pelaburan dalam kecerdasan buatan. Keputusan suku kedua Amazon menyediakan konteks kewangan untuk pembinaan infrastruktur.
NVIDIA melaporkan pendapatan Pusat Data sebanyak $89 bilion untuk suku fiskal kedua tahun 2027. Ini mewakili peningkatan sebanyak 117% berbanding suku yang sama tahun sebelumnya.
NVIDIA juga melaporkan bahawa platform Vera Rubinnya telah memasuki pengeluaran penuh, dengan penggunaan rakan kongsi yang melibatkan CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructure, dan Nebius. Jensen Huang, pengasas dan Ketua Pegawai Eksekutif NVIDIA, berkata, “Dan permintaan semakin meningkat”. Keputusan kewangan NVIDIA difailkan dengan SEC menyokong kenyataan itu dengan pertumbuhan pendapatan Pusat Data syarikat yang dilaporkan.
Servis GPU Infrastruktur Yang Telah Disediakan Oleh AWS?
AWS sudah menyediakan GPU contoh berdasarkan beberapa NVIDIA seni bina. Dua juta yang baru diumumkanGPU pelaksanaan akan mengembangkan portfolio ini dalam tempoh dua tahun akan datang.
AWS melancarkan tika EC2 G7 menggunakan NVIDIA RTX PRO 4500 Edisi Pelayan Blackwell GPUs pada Jun 2026. Konfigurasi G7 menyokong sehingga lapan GPUs, 256 GB gabungan GPU memori, 192 CPU maya, 768 GiB memori sistem, 7.6 TB storan NVMe tempatan dan 700 Gbps lebar jalur rangkaian.
AWS mengatakan bahawa contoh G7 memberikan sehingga 4.6 kali ganda prestasi inferens AI dan 2.1 kali ganda prestasi grafik generasi G6 sebelumnya. Ini adalah perbandingan yang dilaporkan oleh AWS dan bukannya bebas. HostScore tanda aras.
Instans G7 pada mulanya tersedia di wilayah Ohio Timur AS dan Oregon Barat AS melalui Atas Permintaan, Pelan Penjimatan, Spot dan konfigurasi Instans Khusus terpilih. Pengumuman EC2 G7 AWS menyediakan spesifikasi instans semasa dan ketersediaan serantau.
HostScore's Take
Dua juta itu-GPU komitmen mengesahkan bahawa AWS dan NVIDIA menjangkakan permintaan pengiraan AI akan kekal tinggi. Walau bagaimanapun, pengumuman itu tidak menetapkan berapa kos kapasiti baharu, wilayah mana yang akan menerima setiap GPU model, atau apabila jenis tika individu akan tersedia.
Kesan Berpotensi terhadap Kos Pengehosan AI
Lebih banyak kapasiti boleh memudahkan ketersediaan perkakasan, tetapi ia tidak menjamin harga hosting yang lebih rendah. GPU Kos pengehosan termasuk pemecut, peruntukan CPU, RAM, storan, rangkaian, pemindahan data, pengurusan dan kapasiti simpanan.
Sistem Blackwell Ultra, Rubin dan Rubin Ultra juga menyasarkan beban kerja AI yang semakin mencabar. Sistem ini mungkin memberikan lebih banyak kerja setiap GPU, tetapi itu tidak secara automatik mengurangkan kos permulaan untuk projek yang lebih kecil.
Pembeli harus menunggu spesifikasi contoh, ketersediaan serantau dan harga sebelum mengira kesan kewangan pengembangan AWS.
Peranan Lebih Kecil GPU Penyedia Hosting
AWS sesuai dengan organisasi yang memerlukan GPU kluster dan integrasi rapat dengan perkhidmatan seperti Bedrock, SageMaker, OpenSearch, S3 dan Elastic Kubernetes Service. Bukan setiap projek AI memerlukan skala atau kedalaman platform tersebut.
Penyedia infrastruktur khusus boleh melayani perniagaan yang mahukan perkhidmatan yang diketahui GPU konfigurasi, akses pelayan langsung, perkakasan khusus atau pengaturan pengebilan yang lebih mudah. Atlantic.Net, sebagai contoh, kini menyediakan awan dan khusus GPU konfigurasi menggunakan NVIDIA Perkakasan L40S dan H100 NVL. Konfigurasi awannya menyokong pengebilan setiap jam dan jangka panjang, manakala pelayan khusus menyediakan perkakasan tetap dan akses root. Atlantic.Net menyenaraikan semasanya GPU konfigurasi di sini.
Atlantic.Net bukanlah pengganti langsung untuk kluster teragih terbesar AWS. Ia mewakili lapisan lain bagi GPU pasaran hosting untuk latihan, inferens, penyelidikan dan beban kerja infrastruktur khusus yang lebih kecil.
Implikasi terhadap GPU Pasaran Hosting
Perniagaan harus sepadan GPU infrastruktur kepada beban kerja dan bukannya jumlah kapasiti penyedia.
Latihan model bergantung kepada GPU ingatan, berbilangGPU rangkaian, daya pemprosesan storan dan kebolehskalaan kluster. Penalaan halus boleh berjalan dengan cekap pada satu memori tinggi GPU, bergantung pada model dan set data. Pembeli inferens harus mengukur kependaman tindak balas, keserentakan, masa pemuatan model, penggunaan dan kos setiap permintaan yang telah diselesaikan. Beban kerja jangka panjang harus membandingkan harga awan yang dikhaskan dengan khusus GPU pelayan, manakala projek eksperimental mendapat manfaat daripada pengebilan setiap jam dan peruntukan yang pantas.
Prestasi CPU, RAM sistem, storan NVMe, lebar jalur rangkaian dan konfigurasi perisian juga mempengaruhi GPU penggunaan. Pemecut yang berkuasa tidak dapat mencapai prestasi yang dijangkakan apabila infrastruktur di sekelilingnya tidak dapat membekalkan data dengan cukup cepat.