GMI Cloud
GMI Cloud 是一家 AI 原生 GPU 云,面向训练、微调与推理。2026-08-25 复核:gmicloud.ai/en/pricing 标注 H100 低至 $2.00 / GPU 时、H200 $2.60、B200 $4.00、GB200 $8.00,按需计费、无隐藏费用。英伟达将 GMI Cloud 列为全球六个 Reference Platform Cloud Partner 之一。不要凭空捏造我们打开页面没有的企业套餐。
对比 OpenGradient(去中心化可验证推理)、Modal(serverless 沙箱)与 Ollama(本地模型托管)。
核心功能
- Dedicated NVIDIA GPU:H100、H200、B200 以及 Blackwell GB200/GB300 按需提供,运行在 GMI 自营数据中心,配 InfiniBand 互联。
- 按需付费:按小时计费,无最低承诺,不强迫长期预留;只有在你主动选择时才享受承诺折扣。
- GPU Compute + Inference + Cluster:按需实例,外加自动伸缩、兼容 OpenAI 的推理 API,覆盖文本、图像、视频与音频模型。
- 区域覆盖:美国与亚太,适合想要近距旗舰芯片的团队。
- 托管技术栈:Kubernetes 管理镜像,带 TensorRT 与 NVIDIA 预置容器(Triton 等)。
局限:属于中型厂商。对超大算力或最深度的集成生态,超大规模云与 CoreWeave 级平台走得更远。
适用场景
- 微调与训练任务,需要可靠且无需排队的按需 H100/H200。
- 生产推理,用 serverless 的 OpenAI 兼容端点或预留裸金属。
- 亚太团队,希望用美国/亚太区域获得低时延并统一计费。
定价方案
2026-08-25 公开定价,来源 gmicloud.ai/en/pricing。
| GPU | 价格 | 说明 |
|---|---|---|
| NVIDIA H100 | 低至 $2.00 / GPU 时 | 按需,无隐藏费用。 |
| NVIDIA H200 | $2.60 / GPU 时 | 供应有限。 |
| NVIDIA B200 | $4.00 / GPU 时 | Blackwell。 |
| NVIDIA GB200 | $8.00 / GPU 时 | Blackwell,可立即获取。 |
| NVIDIA GB300 | 预购 | 英伟达新一代。 |
英伟达还指出 GMI Cloud 是 DGX Cloud Lepton 的早期贡献者。预算前请复核实时页面,价格会变动。
快速开始
- 打开 gmicloud.ai 注册账户。
- 选择按需 GPU 实例,或启动推理端点。
- 部署预置 TensorRT/Triton 镜像,或自带容器。
- 长时间训练时留意小时级计费。
官方起点:gmicloud.ai 与 docs.gmicloud.ai。
常见问题
有 spot 实例吗?
我们打开的是专用算力目录,页面未见 spot 定价。
比超大规模云便宜吗?
GMI 声称相对部分方案成本最高可降约 50%,并给出中等价位的 spot 对比。请当作公司口径而非审计结论。
有免费层级吗?
我们打开的页面没有公开免费层。计费为按 GPU 时按需计费。
替代方案
- OpenGradient:去中心化可验证推理。
- Modal:serverless 沙箱与缩容到零。
- Ollama:本地模型运行器加可选云。
使用技巧
- 引用官网定价页的 H100 低至 $2.00 / $2.60 / $4.00 / $8.00,而非旧截图。
- 多周预留前先复核实时定价页。
- 使用 OpenAI 兼容端点时,确认模型目录匹配你的工作负载。
总结
GMI Cloud 是英伟达背书的 GPU 云,H100 按需低至 $2.00 / GPU 时并提供推理 API,而非企业订阅。先到 gmicloud.ai 开始,再判断 Modal 是否已覆盖你需要的沙箱。
评论
还没有评论。成为第一个评论的人!
相关工具
OpenGradient
www.opengradient.ai
可验证 AI 推理的去中心化 Layer 1:ZKML / TEE / Vanilla,HACA、PIPE、x402 与 Model Hub。复核:主网 4500+ 模型。
9Router
9router.com
免费 MIT 协议的 AI 路由器与 token 压缩器:把 Claude Code、Codex、Cursor、Cline 接入 40+ 供应商,支持自动回退与 RTK 压缩。
CheaperInference
cheaperinference.com
CheaperInference 以折扣价转售 AI 推理算力,一个 OpenAI 兼容 API 接入多家模型,最高节省 30%,按量付费、无合约约束。