用于 ML 研究的 GPU · 无需 KYC 的加密货币支付
IteraGPU
GPU 目录 / NVIDIA H100 PCIe 80GB
Location GPU / NVIDIA

NVIDIA H100 PCIe 80GB

H100 PCIe 将 Hopper 架构与每卡 80 GB 显存结合在一起。它让你能够在单张 GPU 上考察 ML 负载,同时关注整条流水线,尤其是在数据准备或传输占据重要位置时。

您的配置

每批 GPU 数量
1
每块 GPU 的内存
80 Go
内存类型
HBM2e
可用库存
27 cartes

3 天、7 天或 30 天的套餐。组数在下一步选择。

加密货币支付,无需 KYC 或身份证件;仅需名、姓和邮箱以便跟踪订单。

支付流程
您的租赁3 / 7 / 30 天

NVIDIA H100 PCIe 80GB

包含 1 块 GPU · 每块 80 GB · HBM2e

套餐总计 · 3 天

USD 180.00

有 27 张卡可用。

租用此配置

为你的应用真正执行的操作计时

对已驻留 GPU 的张量进行测试,只能描述纯计算部分。而一个服务或一次训练还需要解码、准备和传输输入。因此请构建两种测量:孤立的计算循环,以及从你日常数据出发的循环。两者之差指明了该去哪里寻找优化空间。记录时间前请等待 GPU 工作真正结束;CUDA 启动通常是异步的。

将 batch 用作受控变量

对于离线推理,在保持输入长度和类型不变的前提下比较多种批大小。对于交互式应用,还要测量单个请求的延迟以及最慢请求的延迟。使处理量最大化的 batch 可能让等待变得难以接受。在 80 GB 上,请为缓存或激活值留出空间,而不是在模型加载时就停止尺寸规划。

请分别记录权重精度与计算精度。以缩减格式存储的模型在运行时仍可能使用更高精度的缓冲区或运算。

比较 H100 各变体,但不要混为一谈

本页面针对 H100 PCIe 80 GB。H100 SXM 或多卡组合的结果并不能自动代表该配置。请针对你的架构检查 CUDA、PyTorch 和专用库,然后选择一套适用于所比较 GPU 的共同方案。如果 80 GB 不够用,请研究 H200;如果需求在 48 GB 以内,请把 L40S 加入你的经济性比较。

准备一份面向流水线的订单

三天可用于确定计算与传输所占的比例。七天可以测试修正并重复测量。三十天则能支撑一轮推理活动或计划好的训练。选择时长和数量,填写您的环境信息,然后是您的跟踪联系方式。订单中的加密货币说明会指明网络和金额;“我已付款”按钮用于告知您的转账。

在此配置上准备您的首次试用

GPU 规格表描述的是一种能力。这些方法帮助您在自己的工作负载上确定输入、调优和目标校验结果。