Vast.ai
若要第一方 serverless GPU 价表,对比 Modal;若要的是智能体沙箱而不是租一张卡,对比 E2B。
核心功能
- 市场,不是预留云:主机挂牌。你选可中断或按需。
- 偏按秒计费:最低充值和磁盘计量以控制台为准。
- Docker / SSH / Jupyter:常见启动路径仍是容器加 SSH。
- 可靠性档:界面仍区分更便宜的社区主机和已验证 / 机房报价。最便宜不一定是跑完最便宜。
适用场景
- 可以死掉重来的短 GPU 任务。
- 超大规模标价会很痛、但能接受主机差异的微调。
- 不需要沙箱产品、只要一张卡的人。
定价
2026-08-17 控制台看到的例子,不是价卡:
| 当天看到的报价 | 大约 |
|---|---|
| RTX 5090 可中断 | ~$0.27–$0.36 / 小时 |
| RTX 5090 按需 | ~$0.57 / 小时 |
| H200 NVL 可中断 | ~$1.48 / 小时 |
引用任何 GPU 前,再看 vast.ai/pricing 或搜索界面。
快速开始
- 在 vast.ai 注册。
- 按 GPU 和可中断 / 按需筛选。
- 启动模板,再 SSH。
- 任务结束就销毁实例。市场上的空闲时间仍是你的账单。
常见问题
一定比 AWS 便宜吗?
就我们看到的报价,常常是。这不是保证折扣。
能当智能体沙箱用吗?
可以在容器里执行。它不是 E2B。
1.7 万 GPU 的统计还对吗?
不是我们保留的第一方句子。
替代方案
使用技巧
- 宕机比标价贵时,按已验证主机排序。
- 核对磁盘和带宽附加项。它们不总在 GPU 小时里。
- 不要把 GTX 1080 行当成 2026 目录。
评论
还没有评论。成为第一个评论的人!
相关工具
Month Visit4000000DR: 90AS: 92
Month Visit1500000DR: 85AS: 87
Month Visit50000000DR: 95AS: 95
相关洞察

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
别再把 AI 助手塞进聊天框了:Clawdbot 选错了战场
Clawdbot 很方便,但将它放在 Slack 或 Discord 里操控,是从一开始就错的设计选择。聊天工具不是用来操作任务的,AI 也不是用来聊天的。

Grok Bot、Hermes Bot:一个人,终于配上了智囊团和秘书处
Grok Bot 进了 Cursor Pro+,Hermes Bot 能跑在 VPS 上。它们不是更聪明的聊天框。出主意的是智囊团,抓落实的是秘书处,拍板的还是你。