GPU cho nghiên cứu ML · Thanh toán crypto không KYC
IteraGPU
Danh mục GPU / 2 × NVIDIA B200 SXM
Location GPU / NVIDIA

2 × NVIDIA B200 SXM

Gói hai B200 SXM dành cho các thí nghiệm có lý do rõ ràng để dùng hai GPU: phân bổ một mô hình, phân tán một quá trình huấn luyện hoặc chạy hai biến thể độc lập. Mỗi card có 180 GB HBM3e; chiến lược phần mềm của bạn quyết định cách khai thác những dung lượng này.

Cấu hình của bạn

GPU mỗi lô
2
Bộ nhớ mỗi GPU
180 Go
Loại bộ nhớ
HBM3e
Tồn kho khả dụng
4 lô 2 cái

Các gói 3, 7 hoặc 30 ngày. Số lô được chọn ở bước tiếp theo.

Thanh toán bằng crypto không cần KYC hay giấy tờ tùy thân; họ, tên và email để theo dõi đơn hàng.

Quy trình thanh toán
Thuê của bạn3 / 7 / 30 ngày

2 × NVIDIA B200 SXM

Bao gồm 2 GPU · 180 GB mỗi card · HBM3e

Tổng gói · 3 ngày

887,57 USD

Có 4 lô 2 card.

Thuê cấu hình này

Trước tiên chọn điều mà hai card chia sẻ

Trong song song dữ liệu cổ điển, mỗi GPU giữ một bản sao của mô hình và nhận một phần batch. Với mô hình quá lớn so với một card, cần phân bổ tham số hoặc các lớp. Vậy nên 360 GB cộng lại không tự động tạo thành một phân bổ duy nhất. Hãy viết giả thuyết của bạn trước khi thuê: tăng batch toàn cục, giảm thời gian một bước hoặc làm cho một lần chạy trở nên khả thi.

Một thử nghiệm phân bổ đưa ra kết luận

Hãy bắt đầu với cùng một tập dữ liệu thu nhỏ trên một card, nếu mô hình vừa, rồi trên hai card. Ghi lại đỉnh bộ nhớ của từng GPU, thời gian mỗi bước sau khi khởi động và chi phí trao đổi. Một card gần như trống và card kia quá tải gợi ý phân bổ mất cân bằng. Hai thí nghiệm độc lập có thể hữu ích hơn một huấn luyện phân tán khi câu hỏi của bạn xoay quanh nhiều siêu tham số.

Giữ độ chính xác và số ví dụ được xử lý không đổi trong suốt so sánh này. Một cải thiện đạt được khi đồng thời thay đổi định dạng số và kích thước batch sẽ khó quy cho phần cứng.

Chuẩn bị ngăn xếp Blackwell và chọn một phương án thay thế

Hãy kiểm tra xem phiên bản PyTorch, bản phân phối CUDA và các extension đã biên dịch của bạn có nhắm đúng vào Blackwell hay không. Một kernel tùy chỉnh tương thích với một thế hệ khác không đủ để thiết lập khả năng tương thích này. Hãy kiểm thử các phép toán thiết yếu trước chiến dịch đầy đủ. Nếu mô hình và phần dự trữ khi chạy của bạn vừa với 141 GB, H200 cho phép nghiên cứu chạy trên một GPU duy nhất; MI300X mở ra một hướng khác cho dự án đã chuẩn bị cho ROCm.

Đặt một khung nghiên cứu khả thi

Ba ngày phù hợp cho một kiểm chứng phân bổ đã chuẩn bị trước. Bảy ngày cho phép tổ chức nhiều biến thể và đánh giá chúng. Ba mươi ngày tương ứng với một chiến dịch theo dõi, với các checkpoint và tiêu chí dừng đã xác định. Chọn số lô hai card, thời lượng và môi trường mong muốn, rồi điền thông tin liên hệ. Sau khi chuyển crypto, dùng “Tôi đã trả tiền” trong đơn hàng; sau đó làm theo các bước thanh toán và chuẩn bị quyền truy cập.

Chuẩn bị lần chạy thử đầu tiên trên cấu hình này

Thông số GPU mô tả một năng lực. Những phương pháp này giúp bạn xác định đầu vào, cách tinh chỉnh và kết quả cần kiểm chứng trên chính khối lượng công việc của mình.