多轮对话连贯性
Trinity 的定位是支持多轮交互,能够在长会话中保持目标和约束不变,从而减少重复说明上下文的需要。
Arcee AI 是一家美国开放智能实验室,专注开源权重基础模型。其 Trinity 系列是网站上展示的主要产品线,相关模型旨在本地、私有化或云端环境中运行,同时在不同规模之间保持相同的大致能力特征。
产品页面将 Trinity 定位于实际生产使用:多轮对话、工具调用、结构化输出和长上下文任务。Arcee 还强调开源权重许可、可移植权重,以及在不同部署形态之间迁移工作负载而无需重建提示词或工作流的能力。
Trinity 的定位是支持多轮交互,能够在长会话中保持目标和约束不变,从而减少重复说明上下文的需要。
该模型家族针对准确的函数选择、有效参数以及符合 schema 的 JSON 进行了训练,因此适合智能体式工具工作流。
Arcee 表示,不同规模的模型共享相同的能力特征,因此团队可以先在较小模型上测试,再迁移到更大规模部署,而无需重做提示词或流程。
该系列包含开源权重版本和托管 API,让团队可以在本地控制与托管部署之间进行选择。
Trinity 页面强调长上下文支持和高效注意力,旨在降低长上下文工作负载的成本。
该模型家族提供面向边缘、云端和推理型部署的变体,包括 Nano、Mini 和 Large Thinking。
当你需要一个可在消费级 GPU、边缘服务器、移动级设备或其他对延迟敏感的环境中本地运行的模型时,可以使用 Nano。
对于面向客户的应用、智能体后端以及需要在云端或 VPC 中以开源权重部署的高吞吐服务,可以使用 Mini。
当工作负载依赖复杂工具链、更长的推理链或更高要求的智能体行为时,可以使用 Large Preview 或 Large Thinking。
对于需要符合 schema 的 JSON、函数调用或其他可被下游系统消费的结构化输出的应用,可以使用该系列。
当你希望使用托管访问时,可以使用托管 API;当你需要本地控制和基础设施所有权时,可以下载权重。
Trinity 是一个开源权重语言模型家族,适用于多轮对话、工具调用和结构化输出。源描述称,它既可以通过托管 API 使用,也可以下载权重后在本地运行。
Trinity 页面列出了 Nano,适用于边缘和隐私敏感部署;Mini,适用于云端和私有化生产;以及 Large 变体,适用于云端部署。该家族在不同规模之间保持相同的大致能力特征,因此你可以在不同部署形态之间切换,而无需更改提示词。
源描述称,Trinity 支持准确的函数选择、有效参数、符合 schema 的 JSON、工具失败时的平稳恢复,以及连贯的长会话对话。它专为依赖结构化输出和工具编排的智能体工作流而设计。
Arcee 将 Trinity Nano 和 Mini 描述为支持 128K 上下文窗口,而 Trinity Large 变体在产品页面上列为 512K 上下文窗口。整个网站也强调长上下文使用和持续的多轮连贯性。
源内容未提供公开定价页面。不过,Trinity 页面提到了托管式 API、开源权重,以及企业支持/联系销售的路径。