用于 AI 训练的人类智能
Mercor 表示,其以规模化方式支持前沿研究、RLHF 数据和 AI agent 训练,并使用人类专业知识处理需要领域判断的任务。
Mercor 是面向前沿研究、human-in-the-loop 训练数据、企业 agent 和基准评测的 AI 平台,服务需要领域专业知识、任务数据与可衡量 agent 表现的 AI 实验室和企业。
Mercor 是一个专注于为 AI 工作组织人类智能的平台。在其网站上,它围绕前沿研究、RLHF 数据、AI agent 训练,以及以人类专业知识为基础的企业 AI 系统进行定位。
该公司的产品面向涵盖三大领域:面向前沿模型的研究与评测、用于业务流程的企业 agent 部署,以及 APEX 等用于衡量模型和 agent 在经济价值任务上表现的基准。网站还展示了活跃招聘,以及支持这些服务的大型承包商网络。
Mercor 表示,其以规模化方式支持前沿研究、RLHF 数据和 AI agent 训练,并使用人类专业知识处理需要领域判断的任务。
Mercor Enterprise 先收集公司的工作流程和隐性知识,再利用这些输入识别高价值 agent 及其部署路线图。
企业版围绕公司自身对高质量工作的定义构建 agent,然后将其部署到工作中,持续学习并不断改进。
Mercor Enterprise 包含基准评测,用独立、可重复的评估对 AI 产品进行压力测试,并清晰展示成功与失败模式。
Mercor Research 产出前沿数据、RL 环境、基准、同行评审研究、评测排行榜、数据集以及开源工具。
APEX 基准衡量 AI 在专业服务、医疗、软件工程和消费活动等经济价值任务上的表现。
团队可以接入 ATS 数据和岗位评分标准来筛选大量候选人池,然后返回校准后的评分卡和通过/不通过建议,同时让招聘人员参与其中。
工程或运维团队可以使用该平台检测事件、生成运行手册、识别根因,并在可观测性和事件工具之间缩短缓解时间。
咨询、金融和战略团队可以将来自内部和外部研究来源的信息整合为投资论点、竞争研究或市场进入材料。
销售、法务、合规和 IT 团队可以联合输入来生成 RFP 初稿,而无需在各部门之间手动追问上下文。
组织可以通过独立评测对其 AI 产品或 agent 进行基准测试,展示系统在哪些方面表现良好、失效或需要改进。
Mercor 似乎专注于 human-in-the-loop 的 AI 工作:前沿研究、RLHF 数据、AI agent 训练,以及围绕公司特定标准构建的企业 AI agent。
该网站将 Mercor 定位为面向顶尖 AI 实验室和企业,同时也强调其被研究团队、工程团队,以及招聘、咨询、金融、销售和业务运营团队使用。
Enterprise 页面描述的工作流可能包括诊断工作流程、部署 agent、对 AI 产品进行基准评测,以及将企业数据变现。Research 页面则聚焦于前沿数据、RL 环境、基准和评测工具。
定价页面不可用并返回 404,因此在所提供的来源中,网站未公开定价细节。