大型模型库
浏览包含 1,000+ 个可直接用于生产的模型的库,覆盖图像、视频、音频和 3D 任务,并提供带有“立即试用”和文档链接的模型页面。
fal 是面向开发者的生成式媒体平台,提供模型 API、Serverless 推理和专用 GPU 算力,适用于图像、视频、音频和 3D 工作负载,支持发现模型、运行生成任务,并按用量或按小时计费扩展自定义 AI 作业。
fal 是面向开发者的生成式媒体平台,将图像、视频、3D、音频和语音模型整合到一个产品界面中。网站将其定位为一个可以运行可直接投入生产的模型、通过模型 API 调用它们,并借助 Serverless GPU 或专用算力扩展自定义 AI 工作负载的平台。
首页强调一种面向开发者的工作流,帮助他们在无需管理太多基础设施的情况下快速集成模型。实际使用中,fal 将工作负载分为三类:用于直接生成的模型 API、用于自动扩缩推理端点的 Serverless,以及用于训练、微调、批处理和分布式工作负载的持续 GPU 访问 Compute。
浏览包含 1,000+ 个可直接用于生产的模型的库,覆盖图像、视频、音频和 3D 任务,并提供带有“立即试用”和文档链接的模型页面。
通过一个简单的 API 直接调用模型,主页将其描述为统一的开发者工作流,许多模型无需微调或额外设置。
通过 Serverless GPU 运行按需推理,可从 0 自动扩展到数千个 GPU,并避免自行规划冷启动基础设施。
为训练、微调、批处理以及需要完整 SSH 访问和可预测按小时计费的长时运行工作负载提供专用 GPU 实例。
在企业级基础设施上部署私有或微调模型,并接入自有权重和私有端点。
对许多模型 API 使用按输出计费的定价方式,定价页面按输出单位进行归一化,便于跨模型比较。
通过模型 API 构建生成或编辑图像和视频的应用,并使用模型库选择适合任务的模型。
运行可随流量自动扩展且几乎无需基础设施管理的生产级推理端点。
当作业需要持续访问硬件和 SSH 控制时,在专用 GPU 实例上训练或微调模型。
使用 8xH100 Compute 实例进行分布式训练或多 GPU 推理,以受益于 InfiniBand 互联节点。
从单一目录探索新模型,并在集成前比较图像和视频选项的按输出计费价格。
fal 是面向开发者的生成式媒体平台。它提供模型 API、Serverless 运行时和专用算力,用于运行图像、视频、音频和 3D 工作负载。
来源内容显示了统一的 API 和 SDK,但没有列出具体的语言 SDK 或设置步骤。主页说明开发者可以直接调用模型,而算力文档解释了专用 GPU 实例的基于 SSH 的访问方式。
主页和模型库重点展示了图像、视频、音频和 3D 模型。模型库还展示了用于文生图、图生视频、编辑、超分辨率、背景移除和音乐生成等任务的模型页面。
fal 提供按用量计费的模型 API 定价,以及单独的 Serverless 和 Compute 定价。定价页面说明 Serverless 和 Compute 的计费方式不同,其中 Compute 按小时计费,而部分模型 API 按输出单位计费。
Compute 适用于训练、微调、批处理以及其他需要持续访问 GPU 硬件的工作负载。文档将其与 Serverless 进行对比,后者面向自动扩缩和按需推理。
流量数据仅供参考。
| 3月 | 2556690 |
|---|---|
| 4月 | 2595836 |
| 5月 | 2300237 |