本地与云端模型执行
可在你自己的硬件上离线或本地工作流中运行模型,也可在需要更大或更快系统时使用云端模型。
Ollama 是一个用于在本地或云端使用开源模型的平台。网站将其定位为一种在保护数据隐私的同时自动化处理开源模型工作的方式,并支持从简单聊天到编码、文档分析和 agent 任务等多种工作流。
该产品将本地模型执行与云端访问结合起来,以便使用更大或更快的模型。其网站界面包含模型浏览、桌面安装下载流程、集成与 API 文档,以及将本地硬件不限量使用与按量计费的云端使用区分开的定价层级。
可在你自己的硬件上离线或本地工作流中运行模型,也可在需要更大或更快系统时使用云端模型。
通过网站的模型浏览体验,从用于聊天、编码、视觉、嵌入、推理和 agent 工作流的模型中进行选择。
可通过 CLI、API、桌面应用和库使用 Ollama,并提供集成与首次 API 请求的文档。
可将 Ollama 连接到应用、编辑器和 agent,包括首页中突出展示的 Claude Code 等工具及其他 agent 工作流。
可访问经过工具调用与真实 agent 工作流测试的云端模型,具体说明见定价 FAQ。
可为更重的工作负载使用付费云端方案,包括并发模型运行和更大模型,同时在你自己的硬件上保持本地运行不限量。
当你需要离线运行,或希望将敏感工作保留在自己的硬件上时,可在本地机器上运行开源模型。
使用云端模型进行编码自动化、文档分析以及其他受益于更大或更快模型的任务。
通过文档化的集成与 API 路径,将 Ollama 连接到应用、编辑器或 agent,以构建由模型驱动的工作流。
在为特定任务选择模型时,可浏览适用于聊天、编码、视觉、嵌入和推理的可用模型。
使用付费方案完成需要多个并发模型或更高使用限额的持续性工作。
Ollama 支持在你自己的硬件上本地运行模型,其文档也提到可使用云端模型处理更大规模的工作负载。定价页面说明,本地硬件使用不限量,而云端使用取决于所选方案。
网站说明 Ollama 可以连接到应用、编辑器和 agent,其文档还包括集成说明以及 API 参考、Python 和 JavaScript 库。
定价页面说明,支持工具的云端模型在上线前会针对工具调用和真实 agent 工作流进行测试。
下载页面提供 macOS、Linux 和 Windows 的安装程序,Windows 页面注明需要 Windows 10 或更高版本。
不会。定价页面说明,提示词或回复数据绝不会被记录或用于训练,首页也写明你的数据仍然属于你。