AWS dan NVIDIA Rencanakan Dua Juta Lagi GPUSeiring dengan meningkatnya permintaan hosting AI.

Pengungkapan: Konten dalam HostScore.net Bagian berita dapat memuat kiriman PR berbayar dari pihak ketiga. Pandangan yang diungkapkan semata-mata merupakan pandangan perusahaan masing-masing. Pelajari lebih lanjut tentang kiriman PR kami di sini.

AWS dan NVIDIA berencana mengerahkan dua juta tambahan GPUpenyebaran di seluruh infrastruktur AWS selama tahun 2027 dan 2028. Penyebaran yang direncanakan akan mencakup NVIDIA Blackwell Ultra, Rubin, dan Rubin Ultra GPUuntuk pelatihan AI, inferensi, komputasi ilmiah, otomatisasi perusahaan, dan beban kerja AI fisik.

Pengumuman tersebut menjelaskan komitmen infrastruktur di masa depan, bukan dua juta unit yang tersedia secara langsung. GPUHal ini mengikuti rencana AWS sebelumnya untuk menambahkan lebih dari satu juta. NVIDIA GPUdimulai pada tahun 2026.

Rencana Infrastruktur yang Diperluas oleh AWS dan NVIDIA

AWS dan NVIDIA mengumumkan perluasan kemitraan pada 26 Agustus 2026. Kedua perusahaan mengatakan tambahan GPUakan diterapkan di seluruh infrastruktur global AWS, termasuk sistem yang digambarkan sebagai pabrik AI.

Kemitraan ini mencakup lebih dari GPU kapasitas. AWS dan NVIDIA juga berencana untuk:

  • Memperkenalkan infrastruktur berdasarkan NVIDIA CPU Vera.
  • Memperpanjang NVIDIA NVLink Fusion dengan memori bandwidth tinggi khusus.
  • Mengintegrasikan NVIDIA GPUdengan AWS Nitro dan jaringan Elastic Fabric Adapter.
  • Terus berikan NVIDIA Model Nemotron tersedia melalui Amazon Bedrock dan SageMaker.
  • Percepat pemrosesan data dan pengindeksan vektor melalui Amazon EMR dan OpenSearch.
  • Terapkan platform AI fisik NVIDIA pada beban kerja Amazon Robotics.

Perusahaan-perusahaan tersebut juga berencana membangun infrastruktur AI untuk pemerintah AS. Ini termasuk 100,000 GPUpada sistem AWS yang aman yang ditujukan untuk beban kerja federal dan keamanan nasional pada Tingkat Dampak 6 dan di atasnya.

Matt Garman, CEO AWS, mengatakan bahwa pelanggan “menginginkan kebebasan untuk memilih alat terbaik untuk beban kerja AI mereka”. AWS gabungan dan NVIDIA pengumuman Ekspansi ini disajikan sebagai respons terhadap organisasi yang memindahkan proyek AI dari tahap uji coba ke tahap produksi.

AWS dan NVIDIA berencana mengerahkan dua juta tambahan GPUpenyebaran di seluruh infrastruktur AWS selama tahun 2027 dan 2028. Penyebaran yang direncanakan akan mencakup NVIDIA Blackwell Ultra, Rubin, dan Rubin Ultra GPUuntuk pelatihan AI, inferensi, komputasi ilmiah, otomatisasi perusahaan, dan beban kerja AI fisik.

Apa bukti yang menunjukkan bahwa permintaan infrastruktur AI semakin meningkat?

Amazon dan NVIDIA melaporkan pertumbuhan substansial dalam bisnis cloud dan pusat data mereka sebelum mengumumkan tambahan tersebut. GPU penyebaran.

Amazon melaporkan bahwa AWS menghasilkan penjualan sebesar $42.2 miliar selama kuartal kedua tahun 2026, meningkat 37% dari periode yang sama pada tahun 2025. Amazon juga mengatakan bisnis AWS AI-nya telah melampaui tingkat pendapatan tahunan sebesar $25 miliar dan tumbuh dengan persentase tiga digit dari tahun ke tahun.

Pembelian properti dan peralatan oleh Amazon meningkat sebesar $66.1 miliar selama 12 bulan terakhir. Perusahaan tersebut mengaitkan peningkatan ini terutama dengan investasi dalam kecerdasan buatan. Hasil kuartal kedua Amazon Memberikan konteks keuangan untuk pembangunan infrastruktur.

NVIDIA melaporkan pendapatan Pusat Data sebesar $89 miliar untuk kuartal fiskal kedua tahun 2027. Angka ini menunjukkan peningkatan sebesar 117% dibandingkan kuartal yang sama tahun sebelumnya.

NVIDIA juga melaporkan bahwa platform Vera Rubin mereka telah memasuki tahap produksi penuh, dengan implementasi mitra yang melibatkan CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructure, dan Nebius. Jensen Huang, pendiri dan CEO NVIDIA, mengatakan, “Dan permintaan semakin meningkat”. Hasil keuangan NVIDIA yang diajukan ke SEC. Dukung pernyataan tersebut dengan pertumbuhan pendapatan Pusat Data yang dilaporkan perusahaan.

Apa GPU Infrastruktur apa saja yang sudah disediakan AWS?

AWS sudah menyediakan GPU contoh berdasarkan beberapa NVIDIA arsitektur. Dua juta yang baru diumumkan-GPU Penerapan ini akan memperluas portofolio ini selama dua tahun ke depan.

AWS meluncurkan instance EC2 G7 menggunakan NVIDIA Edisi Server RTX PRO 4500 Blackwell GPUpada Juni 2026. Konfigurasi G7 mendukung hingga delapan GPUs, 256 GB gabungan GPU memori, 192 CPU virtual, 768 GiB memori sistem, 7.6 TB penyimpanan NVMe lokal, dan bandwidth jaringan 700 Gbps.

NVIDIA Edisi Server RTX PRO 4500 Blackwell GPUs

AWS menyatakan bahwa instance G7 memberikan kinerja inferensi AI hingga 4.6 kali lipat dan kinerja grafis 2.1 kali lipat dibandingkan generasi G6 sebelumnya. Perbandingan ini dilaporkan oleh AWS, bukan berdasarkan data independen. HostScore tolak ukur.

Instance G7 awalnya tersedia di wilayah US East Ohio dan US West Oregon melalui On-Demand, Savings Plans, Spot, dan konfigurasi Dedicated Instance tertentu. Pengumuman AWS EC2 G7 memberikan spesifikasi instance dan ketersediaan regional saat ini.

HostScore'mempertaruhkan

Dua juta-GPU komitmen menegaskan bahwa AWS dan NVIDIA Permintaan komputasi AI diperkirakan akan tetap tinggi. Namun, pengumuman tersebut tidak menyebutkan berapa biaya kapasitas baru tersebut, dan wilayah mana yang akan menerima masing-masing kapasitas. GPU model, atau kapan tipe instance individual akan tersedia.

Potensi Dampak pada Biaya Hosting AI

Kapasitas yang lebih besar dapat mempermudah ketersediaan perangkat keras, tetapi tidak menjamin harga hosting yang lebih rendah. GPU Biaya hosting mencakup akselerator, alokasi CPU, RAM, penyimpanan, jaringan, transfer data, manajemen, dan kapasitas cadangan.

Sistem Blackwell Ultra, Rubin, dan Rubin Ultra juga menargetkan beban kerja AI yang semakin menuntut. Sistem-sistem ini dapat memberikan lebih banyak pekerjaan per GPUNamun, hal itu tidak secara otomatis mengurangi biaya awal untuk proyek-proyek yang lebih kecil.

Para pembeli sebaiknya menunggu spesifikasi instance, ketersediaan regional, dan harga sebelum menghitung dampak finansial dari ekspansi AWS.

Peran yang Lebih Kecil GPU Penyedia Hosting

AWS cocok untuk organisasi yang membutuhkan skala besar. GPU klaster dan integrasi erat dengan layanan seperti Bedrock, SageMaker, OpenSearch, S3, dan Elastic Kubernetes Service. Tidak setiap proyek AI membutuhkan skala atau kedalaman platform tersebut.

Penyedia infrastruktur khusus dapat melayani bisnis yang menginginkan layanan yang sudah dikenal. GPU konfigurasi, akses langsung ke server, perangkat keras khusus, atau pengaturan penagihan yang lebih sederhana. Atlantic.Net, misalnya, saat ini menyediakan layanan cloud dan dedicated. GPU konfigurasi menggunakan NVIDIA Perangkat keras L40S dan H100 NVL. Konfigurasi cloud-nya mendukung penagihan per jam dan jangka panjang, sementara server khusus menyediakan perangkat keras tetap dan akses root. Atlantic.Net mencantumkan kondisinya saat ini GPU konfigurasi di sini.

Atlantic.Net Ini bukanlah pengganti langsung untuk klaster terdistribusi terbesar AWS. Ini mewakili lapisan lain dari GPU Pasar hosting untuk beban kerja pelatihan, inferensi, penelitian, dan infrastruktur khusus yang lebih kecil.

Atlantic.Net menyediakan layanan cloud dan dedicated yang didukung NVIDIA. GPU Hosting untuk pelatihan AI, penyempurnaan, inferensi, dan beban kerja akselerasi lainnya.
Atlantic.Net menyediakan layanan cloud dan dedicated yang didukung NVIDIA. GPU Hosting untuk pelatihan AI, penyempurnaan, inferensi, dan beban kerja akselerasi lainnya.

Implikasi bagi GPU Pasar Hosting

Bisnis harus saling menyesuaikan GPU infrastruktur disesuaikan dengan beban kerja, bukan dengan total kapasitas penyedia.

Pelatihan model bergantung pada GPU memori, multi-GPU jaringan, throughput penyimpanan, dan skalabilitas klaster. Penyesuaian halus dapat berjalan efisien pada satu memori tinggi. GPU, tergantung pada model dan dataset. Pembeli inferensi harus mengukur latensi respons, konkurensi, waktu pemuatan model, utilisasi, dan biaya per permintaan yang selesai. Beban kerja jangka panjang harus membandingkan harga cloud yang dipesan dengan dedicated GPU serverSementara itu, proyek eksperimental mendapat manfaat dari penagihan per jam dan penyediaan yang cepat.

Performa CPU, RAM sistem, penyimpanan NVMe, bandwidth jaringan, dan konfigurasi perangkat lunak juga memengaruhi hal tersebut. GPU pemanfaatan. Akselerator yang andal tidak dapat mencapai kinerja yang diharapkan jika infrastruktur di sekitarnya tidak dapat menyediakan data dengan cukup cepat.

/ AWS dan NVIDIA Rencanakan Dua Juta Lagi GPUSeiring dengan meningkatnya permintaan hosting AI.

Lebih dari HostScore

Kirimkan Berita Perusahaan Anda

Mencari peluang publisitas di HostScore.net?

Bagikan pencapaian terbaru perusahaan Anda, pengumuman produk, dan tonggak sejarah perusahaan dengan para pembaca kami. Gunakan formulir pengiriman mandiri dan gateway pembayaran ini untuk memulai dengan segera.

Kirim Berita (Layanan Mandiri)

Jelajahi Situs Web Kami

HostScore didirikan untuk menawarkan kepada mereka yang mencari solusi web hosting kesempatan untuk mempelajari semua yang perlu mereka ketahui tentang host – sebelum menghabiskan satu sen pun untuk mereka