GPU cho nghiên cứu ML · Thanh toán crypto không KYC
IteraGPU
IteraGPU / Cấu hình GPU / NVIDIA H100 SXM 80GB
Location GPU / NVIDIA H100 SXM 80GB

H100 SXM 80 GB: thuê năng lực cho chiến dịch Hopper của bạn.

Thuê một H100 SXM 80 GB tại IteraGPU cho chiến dịch tinh chỉnh hoặc huấn luyện đã chuẩn bị cho Hopper. Chọn khoảng thời gian so sánh của bạn, với ngân sách trọn gói theo lô.

Từ 203,57 USD3 ngày · 1 lô · 1 GPU · 80 GB mỗi GPU

Crypto không cần KYC. Cần có tài khoản: tên, họ, email và mật khẩu. Không cần thủ tục KYC hay giấy tờ tùy thân.

Thuê của bạn3 / 7 / 30 ngày

NVIDIA H100 SXM 80GB

Bao gồm 1 GPU · 80 GB mỗi card · HBM3

Tổng gói · 3 ngày

203,57 USD

Có 63 card.

Thuê cấu hình này
GPU mỗi lô
1
Bộ nhớ mỗi GPU
80 Go
Loại bộ nhớ
HBM3
Số lô còn trống
63

Chọn khoảng thời gian cho chiến dịch của bạn.

Giá bằng USD cho một lô đầy đủ; từ 1 đến 10 lô trong trình cấu hình. Tổng cộng là gói nhân với số lô, không tự động gia hạn.

Chọn Hopper với nhu cầu bộ nhớ đã xác định

Chọn H100 SXM khi chiến dịch của bạn hướng tới một ngăn xếp phần mềm tương thích với Hopper và 80 GB mỗi card khớp với ngân sách bộ nhớ của bạn. Với tinh chỉnh, ngân sách này bao gồm mô hình cơ sở và các activation; với huấn luyện toàn phần, hãy cộng thêm gradient và các trạng thái của optimizer. Nhu cầu của cùng một kiến trúc do đó có thể thay đổi tùy theo phương pháp được chọn.

80 GB có thể tạo chỗ cho một microbatch hoặc những chuỗi vốn gây giới hạn ở một cấu hình nhỏ hơn, nhưng công thức của bạn phải xác lập được biên độ đó. Nếu nó đã chạy trên Ampere và vừa trong 80 GB, A100 SXM đáng để so sánh gói. Nếu dung lượng vẫn chưa đủ, hãy xem xét H200 SXM 141 GB thay vì cho rằng một độ chính xác khác sẽ giải quyết vấn đề mà không cần kiểm chứng.

  • Xác định những gì sẽ được huấn luyện: chỉ adapter hay toàn bộ tham số, cùng các trạng thái đi kèm.
  • Kiểm tra các phiên bản CUDA/PyTorch và các extension cần thiết trước khi chọn cấu hình Hopper này.
  • So sánh ngân sách của khoảng thời gian với kết quả mong đợi của chiến dịch, không suy ra thời gian thực thi từ tên H100.
Ví dụ chiến dịch · 7 ngày

Bảy ngày để so sánh các thiết lập huấn luyện của bạn

Ngân sách thuê là 475,00 USD cho 1 lô H100 SXM, tức 1 GPU 80 GB trong 7 ngày. Chương trình của bạn có thể gồm một công thức tham chiếu, vài biến thể microbatch hoặc độ chính xác tương thích, rồi so sánh các chỉ số và khôi phục checkpoint. Hãy xác định các thử nghiệm ưu tiên trước khi đặt: gói xác định một khoảng thời gian, không bảo đảm mô hình của bạn sẽ hoàn thành bao nhiêu biến thể.

475,00 USD

7 ngày · 1 lô · 1 GPU · 80 GB mỗi GPU

Cấu hình gói 7 ngày này

Hai lựa chọn thay thế để so sánh tùy theo tải của bạn.

7 ngày · 1 lô

NVIDIA A100 SXM 80GB

280,00 USD

7 ngày · 1 lô · 1 GPU · 80 GB mỗi GPU

So sánh một card 80 GB khác khi công thức của bạn đã tương thích với Ampere. Gói và kết quả của giao thức giúp phân định; cùng dung lượng không bảo đảm cùng hành vi hay cùng thông lượng.

Cấu hình 7 ngàyXem toàn bộ thông tin
7 ngày · 1 lô

NVIDIA H200 SXM 141GB

640,00 USD

7 ngày · 1 lô · 1 GPU · 141 GB mỗi GPU

Chuyển sang nghiên cứu một card 141 GB nếu bộ nhớ, chứ không phải lựa chọn độ chính xác, ngăn thí nghiệm của bạn vừa trong 80 GB. H200 vẫn cần được kiểm chứng với phần mềm của bạn và ngân sách của khoảng thời gian đã chọn.

Cấu hình 7 ngàyXem toàn bộ thông tin

Thanh toán tiền thuê trực tiếp bằng crypto.

Thanh toán trực tiếp không cần nạp trước, chẳng hạn bằng BTC trên Bitcoin hoặc USDT trên Tron. Cần có tài khoản: tên, họ, email và mật khẩu. Không cần thủ tục KYC hay giấy tờ tùy thân.

Xem tài sản, mạng lưới và điều kiện thanh toán

Chọn thuê máy của bạn: những câu trả lời hữu ích.

Vì sao chọn H100 SXM cho một chiến dịch fine-tuning?

H100 SXM IteraGPU cung cấp một đường bao 80 GB trên một GPU cho chiến dịch có công thức tương thích với Hopper. Đây là ứng viên khi trọng số, các activation và trạng thái của các tham số được huấn luyện đòi hỏi nhiều chỗ hơn một card nhỏ hơn. Cần định cỡ phương pháp tinh chỉnh của bạn; tên GPU không bảo đảm một mô hình nhất định sẽ vừa cũng không bảo đảm fine-tuning sẽ cải thiện chỉ số của bạn.

Giá một lô H100 SXM cho khoảng thời gian nghiên cứu của tôi là bao nhiêu?

IteraGPU cung cấp 1 lô H100 SXM gồm 1 GPU với 80 GB với giá 203,57 USD trong 3 ngày, 475,00 USD trong 7 ngày hoặc 1.690,00 USD trong 30 ngày. Đây là giá của lô cho các khoảng thời gian trọn vẹn. Hãy chọn khoảng thời gian bao gồm các thử nghiệm, đánh giá chúng và xuất kết quả. Thanh toán trực tiếp bằng crypto không cần nạp trước số dư.

80 GB của H100 SXM có đủ ngay khi trọng số của mô hình vừa vào đó không?

Không. Trên H100 SXM cũng như trên một card khác, khối lượng trọng số chỉ là một phần của bộ nhớ cần thiết. Một quá trình huấn luyện còn dùng các activation, gradient, trạng thái optimizer và các cấp phát tạm thời. Việc tinh chỉnh tham số làm giảm một số khoản này, nhưng không loại bỏ những khoản khác. Hãy kiểm tra mức đỉnh của một bước hoàn chỉnh và của bước đánh giá trước khi chọn lô 80 GB.

Có nên so sánh H100 SXM với A100 SXM hay H200 SXM?

Hãy so sánh với A100 SXM khi công thức của bạn vừa trong 80 GB và chạy trên Ampere: quyết định khi đó dựa trên các gói và giao thức của bạn. Hãy so sánh với H200 SXM khi bạn tìm nhiều bộ nhớ hơn trên một card, với 141 GB thay vì 80 GB. Tại IteraGPU, mỗi lô của ba mô hình này đều gồm 1 GPU. Không đặc điểm nào trong số này đủ để chỉ ra người thắng cho mọi chiến dịch.

Giao thức / phép đo của bạn

Chuẩn bị một chiến dịch mà bạn có thể so sánh.

Đánh giá độ chính xác cùng với hội tụ

Hopper hỗ trợ các phép toán FP8, nhưng định dạng này đòi hỏi một ngăn xếp phần mềm và một mô hình phù hợp. Hãy bắt đầu bằng một lần chạy BF16 hoặc FP16 đã được dự án của bạn kiểm chứng, rồi mới xem xét một biến thể có độ chính xác thấp hơn. Giữ nguyên các ví dụ đánh giá và theo dõi mất mát, các giá trị không hữu hạn và chỉ số cuối cùng. Số bước mỗi giây cao hơn chỉ có giá trị nếu thí nghiệm vẫn trả lời đúng câu hỏi của nó.

Khai thác 80 GB mà không làm sai lệch giao thức

Hãy tăng dần microbatch cho đến khi đạt một mức dư bộ nhớ hợp lý, bằng cách đo một bước bao gồm cả lan truyền ngược. Tích lũy gradient sau đó cho phép xây dựng một batch hiệu dụng lớn hơn mà không đòi hỏi tất cả các mẫu của nó phải nằm đồng thời trong bộ nhớ. Hãy ghi lại cả hai kích thước: chúng không có cùng ý nghĩa đối với hiệu năng hay việc cập nhật tham số.

Trước một chiến dịch dài, hãy thực sự nạp lại một checkpoint và chạy vài bước. Phép thử này phát hiện sớm hơn những thiếu sót về trạng thái optimizer hay lịch tốc độ học so với việc chỉ kiểm tra sự tồn tại của tệp.

SXM, PCIe hay nhiều bộ nhớ hơn?

Hãy giữ một bản dựng CUDA/PyTorch tương thích với Hopper và kiểm tra các tiện ích mở rộng attention của bạn. H100 PCIe là một đối tượng so sánh phù hợp cho công việc trên một card, nhưng một biến thể phần cứng khác phải được đo trên khối lượng công việc của bạn. Hãy ưu tiên xem xét H200 nếu vấn đề chính vẫn là dung lượng bộ nhớ. A100 SXM cũng hữu ích để so sánh chi phí của một thí nghiệm mà các kernel và độ chính xác của nó đã chạy được trên Ampere.

Gắn việc thuê với một sản phẩm nghiên cứu

Trong ba ngày, hướng tới một đường cong tăng batch và một checkpoint có thể tái sử dụng. Trong bảy ngày, hãy so sánh vài cấu hình được chọn lọc kỹ. Trong ba mươi ngày, hãy tổ chức các lần lặp lại và đánh giá trung gian. Hãy đặt hàng với thời lượng, số card và môi trường mong muốn; thanh toán bằng crypto rồi nhấp vào « J’ai payé ». Sổ tay của bạn có thể lưu giữ công thức chính xác của từng lần thử bên cạnh việc theo dõi đơn hàng.

Chuẩn bị lần chạy thử đầu tiên trên cấu hình này

Thông số GPU mô tả một năng lực. Những phương pháp này giúp bạn xác định đầu vào, cách tinh chỉnh và kết quả cần kiểm chứng trên chính khối lượng công việc của mình.

Chiến dịch của bạn, thời lượng của bạn.

NVIDIA H100 SXM 80GB · 203,57 USD cho 3 ngày · 1 lô · 1 GPU · 80 GB mỗi GPU.

Cấu hình thuê 3 ngày