GPU untuk riset ML · Pembayaran kripto tanpa KYC
IteraGPU
Katalog GPU / 2 × NVIDIA B200 SXM
Location GPU / NVIDIA

2 × NVIDIA B200 SXM

Paket dua B200 SXM ditujukan untuk eksperimen yang punya alasan eksplisit menggunakan dua GPU: membagi model, mendistribusikan pelatihan, atau menjalankan dua varian independen. Setiap kartu memiliki 180 GB HBM3e; strategi perangkat lunak Anda menentukan cara memanfaatkan kapasitas tersebut.

Konfigurasi Anda

GPU per lot
2
Memori per GPU
180 Go
Jenis memori
HBM3e
Stok tersedia
4 lot berisi 2

Paket 3, 7, atau 30 hari. Jumlah lot dipilih pada langkah berikutnya.

Pembayaran kripto tanpa KYC maupun dokumen identitas; nama depan, nama belakang, dan email untuk pelacakan pesanan.

Alur pembayaran
Sewa Anda3 / 7 / 30 hari

2 × NVIDIA B200 SXM

2 GPU termasuk · 180 GB per kartu · HBM3e

Total paket · 3 hari

USD 887,57

4 lot berisi 2 kartu tersedia.

Sewa konfigurasi ini

Tentukan lebih dulu apa yang dibagi kedua kartu

Dalam paralelisme data klasik, setiap GPU menyimpan satu salinan model dan menerima sebagian batch. Untuk model yang terlalu besar pada satu kartu, diperlukan pembagian parameter atau lapisan. Jadi 360 GB jika dijumlahkan tidak otomatis menjadi satu alokasi tunggal. Tuliskan hipotesis Anda sebelum menyewa: memperbesar batch global, mempersingkat waktu satu langkah, atau memungkinkan suatu eksekusi.

Uji pembagian yang menghasilkan kesimpulan

Mulailah dengan kumpulan data kecil yang sama pada satu kartu, jika modelnya muat, lalu pada dua kartu. Catat puncak memori setiap GPU, waktu per langkah setelah pemanasan, dan biaya pertukaran. Satu kartu hampir kosong dan kartu lain jenuh menandakan pembagian yang tidak seimbang. Dua eksperimen independen bisa lebih berguna daripada pelatihan terdistribusi ketika pertanyaan Anda menyangkut beberapa hyperparameter.

Jaga presisi dan jumlah contoh yang diproses tetap konstan selama perbandingan ini. Peningkatan yang diperoleh dengan mengubah format numerik sekaligus ukuran batch akan sulit dikaitkan dengan perangkat keras.

Siapkan tumpukan Blackwell dan pilih alternatif

Pastikan versi PyTorch, distribusi CUDA, dan ekstensi terkompilasi Anda menargetkan Blackwell dengan benar. Kernel khusus yang kompatibel dengan generasi lain tidak cukup untuk menetapkan kompatibilitas ini. Uji operasi penting sebelum kampanye penuh. Jika model dan cadangan eksekusi Anda muat dalam 141 GB, H200 memungkinkan pengujian eksekusi pada satu GPU; MI300X membuka jalur lain untuk proyek yang disiapkan untuk ROCm.

Pesan jendela riset yang dapat dieksploitasi

Tiga hari cocok untuk validasi alokasi yang disiapkan sebelumnya. Tujuh hari memungkinkan pengorganisasian beberapa varian dan evaluasinya. Tiga puluh hari setara dengan kampanye terpantau, dengan checkpoint dan kriteria penghentian yang ditetapkan. Pilih jumlah lot dua kartu, durasi, dan lingkungan yang diinginkan, lalu isi data kontak Anda. Setelah transfer crypto Anda, gunakan "Saya sudah bayar" pada pesanan; kemudian ikuti langkah pembayaran dan persiapan akses.

Siapkan uji coba pertama Anda pada konfigurasi ini

Lembar data GPU menjelaskan sebuah kapasitas. Metode ini membantu Anda menentukan input, pengaturan, dan hasil yang perlu diverifikasi pada beban kerja Anda sendiri.