GMI Cloud
对比 OpenGradient(去中心化可验证推理)、Modal(serverless 沙箱)与 Ollama(本地模型托管)。
核心功能
- Dedicated NVIDIA GPU:H100、H200、B200 以及 Blackwell GB200/GB300 按需提供,运行在 GMI 自营数据中心,配 InfiniBand 互联。
- 按需付费:按小时计费,无最低承诺,不强迫长期预留;只有在你主动选择时才享受承诺折扣。
- GPU Compute + Inference + Cluster:按需实例,外加自动伸缩、兼容 OpenAI 的推理 API,覆盖文本、图像、视频与音频模型。
- 区域覆盖:美国与亚太,适合想要近距旗舰芯片的团队。
- 托管技术栈:Kubernetes 管理镜像,带 TensorRT 与 NVIDIA 预置容器(Triton 等)。
局限:属于中型厂商。对超大算力或最深度的集成生态,超大规模云与 CoreWeave 级平台走得更远。
适用场景
- 微调与训练任务,需要可靠且无需排队的按需 H100/H200。
- 生产推理,用 serverless 的 OpenAI 兼容端点或预留裸金属。
- 亚太团队,希望用美国/亚太区域获得低时延并统一计费。
定价方案
2026-08-25 公开定价,来源 gmicloud.ai/en/pricing。
| GPU | 价格 | 说明 |
|---|---|---|
| NVIDIA H100 | 低至 $2.00 / GPU 时 | 按需,无隐藏费用。 |
| NVIDIA H200 | $2.60 / GPU 时 | 供应有限。 |
| NVIDIA B200 | $4.00 / GPU 时 | Blackwell。 |
| NVIDIA GB200 | $8.00 / GPU 时 | Blackwell,可立即获取。 |
| NVIDIA GB300 | 预购 | 英伟达新一代。 |
英伟达还指出 GMI Cloud 是 DGX Cloud Lepton 的早期贡献者。预算前请复核实时页面,价格会变动。
快速开始
- 打开 gmicloud.ai 注册账户。
- 选择按需 GPU 实例,或启动推理端点。
- 部署预置 TensorRT/Triton 镜像,或自带容器。
- 长时间训练时留意小时级计费。
官方起点:gmicloud.ai 与 docs.gmicloud.ai。
常见问题
有 spot 实例吗?
比超大规模云便宜吗?
GMI 声称相对部分方案成本最高可降约 50%,并给出中等价位的 spot 对比。请当作公司口径而非审计结论。
有免费层级吗?
替代方案
- OpenGradient:去中心化可验证推理。
- Modal:serverless 沙箱与缩容到零。
- Ollama:本地模型运行器加可选云。
使用技巧
- 引用官网定价页的 H100 低至 $2.00 / $2.60 / $4.00 / $8.00,而非旧截图。
- 多周预留前先复核实时定价页。
- 使用 OpenAI 兼容端点时,确认模型目录匹配你的工作负载。
总结
GMI Cloud 是英伟达背书的 GPU 云,H100 按需低至 $2.00 / GPU 时并提供推理 API,而非企业订阅。先到 gmicloud.ai 开始,再判断 Modal 是否已覆盖你需要的沙箱。
评论
还没有评论。成为第一个评论的人!
相关工具
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit1000000DR: 45AS: 38
相关洞察
GPT-6 Astra 没追上 Fable 5.1,追上的是账单
Artificial Analysis 智能指数上 Fable 5.1 66 分、Astra 61 分,Astra 没追上智力。但完成同一批任务的成本只要 Fable 5.1 的不到一半,真正收紧的是账单,不是脑子。

Claude Code 使用秘籍:别急着充 200 美元,先走完这套流程
Gmail 配 Apple 隐私登录,Clash Verge 接 Cliproxy 家宽,模拟器也查 IP 和 DNS。订阅每档隔半个月以上,账号出问题先保住 CC 记录。附配置和脚本。
用 magpie 把 Codex 接到任意模型
安装 magpie,加入本地或已登录的供应商,再把 Codex 切到该模型。2026-10-06 对照 magpie 官方文档复核。