Vast.ai logo

Vast.ai

认领

Vast.ai 是按需租用算力的 GPU 云平台,提供实时市场定价与按秒计费,帮助开发者和 AI 团队快速部署用于训练、推理、微调、渲染等 GPU 工作负载的算力。

Vast.ai preview

概述

Vast.ai 是按需租用算力的 GPU 云平台。它主要面向 AI 和机器学习工作负载,但源内容也指出了推理、微调、渲染、转录以及通用 GPU 编程等使用场景。

该平台强调 API 原生部署、实时市场定价和按秒计费。用户可以搜索可用算力、在数秒内部署实例,并根据工作负载和预算在按需、可中断和预留租用之间进行选择。

功能

实时 GPU 市场定价

平台内的价格由供需决定,因此用户看到的是实时市场费率,而不是固定目录价。

多种实例类型

可根据是否需要稳定运行时间、更低成本或更长期容量,在按需、可中断和预留实例类型之间进行选择。

程序化部署工具

使用 CLI、Python SDK 和 REST API,可通过终端或代码启动并管理 GPU 工作负载。

搜索与筛选算力

在部署实例之前,可先搜索报价,并按模型、VRAM、价格和可用性进行筛选。

统一平台 API

使用同一 API 接口来管理实例、计费、密钥、卷、模板和无服务器资源。

快速部署流程

从注册到运行工作负载可在五分钟内完成,并提供 API 密钥访问和按秒计费。

使用场景

  • AI 与机器学习训练

    在需要快速启动并且只为活跃使用付费时,为模型训练、微调和实验提供可扩展算力。

  • 推理与文本生成

    将开源 LLM 或自定义模型作为端点运行,并使用无服务器选项进行自动基准测试、优化以及自动缩容到零。

  • 分布式训练集群

    使用带有 InfiniBand 网络的专用多节点 GPU 集群,处理需要协调节点的大型训练任务。

  • 批处理与转录

    加速转录、批量预处理以及其他可受益于短生命周期算力的 GPU 支持型数据流水线任务。

  • 渲染与虚拟计算

    为图形工作、虚拟计算和 3D 可视化部署支持 GPU 的虚拟机或渲染实例。

Pros and Cons

Pros

  • 跨大量 GPU 的实时定价使比较算力与成本更容易。
  • 按秒计费可减少短时运行或波动型工作负载的浪费。
  • 平台提供 CLI、Python SDK 和 REST API 选项,便于程序化工作流。
  • 用户可以在按需、可中断和预留容量之间进行选择,以匹配工作负载需求。
  • 来源描述其覆盖 40+ 个数据中心和 68+ 种 GPU 类型。

Cons

  • 可中断实例可能会被回收,因此更适合可容错的工作负载,而不适合不能暂停的任务。
  • 来源未提供企业功能、支持等级或正式 SLA 条款的完整细节。

FAQ

如何以程序化方式访问 Vast.ai?

Vast.ai 提供 API 原生的 GPU 云访问。源内容描述了 REST API,以及用于搜索报价、创建实例、管理资源和跟踪计费的 CLI 和 Python SDK。

我多久可以开始使用?

源内容说明你可以从低至 5 美元开始,然后按模型、VRAM、价格和可用性搜索 GPU,再在数秒内部署实例。

Vast.ai 支持哪些类型的工作负载?

Vast.ai 支持 GPU 云、无服务器推理和集群。用例与开发者页面显示,它可用于训练、推理、微调、渲染以及其他 GPU 工作负载。

有哪些定价选项?

定价页面展示了三种实例类型:按需、可中断和预留。可中断实例是可抢占的,可能会被回收;按需强调有保障的正常运行时间;预留适用于更长期的承诺。

Quick Facts

类别
GPU 云 / 开发者工具
主要用户
运行 GPU 工作负载的开发者、AI 团队和运维人员
部署选项
CLI、Python SDK、REST API 和 Web 控制台
定价模式
供需驱动的市场定价,按秒计费
基础设施
40+ 个数据中心中的 20,000+ 块 GPU
来源域名
vast.ai