在一个系统中支持多种搜索模式
在单一查询界面中结合稠密向量、稀疏向量、词法检索、正则匹配和元数据过滤。Chroma 将其定位为一个用于混合搜索工作流的平台。
Chroma 是面向 AI 的开源搜索基础设施,支持向量、全文、正则与元数据搜索,适用于本地、云端及自有云部署;还提供 Chroma Sync 托管采集,助力检索系统与 AI 应用。
Chroma 是面向 AI 的开源搜索基础设施。它将向量搜索、稀疏检索、全文搜索、正则匹配和元数据过滤结合在一起,使团队可以在一个系统中完成搜索与检索,而无需拼接多个独立工具。
该网站展示了三种部署路径:本地单节点选项、用于完全托管无服务器使用的 Chroma Cloud,以及在客户 VPC 中的自有云部署。Chroma Cloud 构建于对象存储和自动分层之上,而 Chroma Sync 则为来自 S3、GitHub 和网站等来源的数据提供托管采集。
该产品面向构建 AI 应用、检索系统和上下文工程工作流的开发者与团队。网站也将其定位为适用于大规模生产搜索,并支持混合搜索、数据集版本管理和企业级部署控制。
在单一查询界面中结合稠密向量、稀疏向量、词法检索、正则匹配和元数据过滤。Chroma 将其定位为一个用于混合搜索工作流的平台。
可通过 pip、npm 或 Docker 在本地运行,或者使用托管云服务。开源数据库和 Chroma Cloud 由同一代码库支撑。
Chroma Cloud 无需预置资源或手动调优即可运行,并构建于对象存储之上,具备自动的、按查询感知的数据分层和缓存。网站强调其无服务器运行方式以及可随使用情况自动扩展。
该架构将向量、元数据和索引存储在对象存储上方的热缓存与温缓存中。Chroma 表示,这种方法旨在支持大规模低延迟搜索。
Chroma Sync 连接 S3 存储桶、GitHub 仓库和网站,然后在内容进入数据库之前对其进行解析、分块和嵌入。
该产品包含数据集分叉、A/B 测试、逐步发布和用于开发的 CLI 工具。网站还强调支持 TypeScript、Python 和 Rust 客户端。
为需要在一个查询路径中同时进行语义匹配、精确文本查找和过滤的 AI 应用构建检索。Chroma 面向希望在不管理独立搜索后端的情况下结合向量方法和词法方法的团队。
在开发期间于本地环境中存储和查询集合,之后再迁移到托管云或 BYOC 部署。网站特别提到了使用 pip、npm 或 Docker 的单节点用法。
从 S3 存储桶、GitHub 仓库或网页中采集内容,并通过解析、分块和嵌入将其准备好用于搜索。这适合需要从原始来源到可搜索数据的托管流水线的团队。
使用对象存储支持的索引、分层缓存和无服务器运行方式来运行大规模生产搜索。网站强调了在多租户索引上进行低延迟搜索,以及随使用情况自动扩展。
使用数据集分叉、A/B 测试和逐步发布,在广泛发布前比较检索变更。这对于持续迭代排序、嵌入或模式更改的团队很有用。
Chroma Cloud 是面向希望在不运行自有集群的情况下使用无服务器搜索基础设施的团队的托管选项。该网站还描述了一个可在本地通过 pip、npm 或 Docker 运行的单节点开源选项,以及在你自己的 VPC 中部署的自有云(BYOC)模式。
该产品将稠密向量搜索、稀疏向量搜索、全文搜索、正则匹配和元数据过滤整合到一个查询界面中。网站还展示了混合搜索和数据集版本管理功能,例如用于 A/B 测试和分阶段发布的分叉。
定价页面显示了 Starter 方案、Team 方案和 Enterprise 方案。Starter 和 Team 采用基于用量的计费并包含额度,而 Enterprise 采用自定义定价,并提供无限数据库、无限团队成员、专属支持、单租户集群和 BYOC 集群等选项。
Chroma Cloud 被描述为通过 Chroma Sync 支持 S3 存储桶、GitHub 仓库和网站。Sync 负责解析、分块和嵌入,使数据可为搜索做好准备。
网站说明,企业部署可以在你的 VPC 中使用 BYOC、多区域复制和时间点恢复。Chroma Cloud 安全页面还指出该平台已通过 SOC 2 Type II 审查。