Mercor logo

Mercor

认领

Mercor 是面向前沿研究、human-in-the-loop 训练数据、企业 agent 和基准评测的 AI 平台,服务需要领域专业知识、任务数据与可衡量 agent 表现的 AI 实验室和企业。

Mercor preview

概览

Mercor 是一个专注于为 AI 工作组织人类智能的平台。在其网站上,它围绕前沿研究、RLHF 数据、AI agent 训练,以及以人类专业知识为基础的企业 AI 系统进行定位。

该公司的产品面向涵盖三大领域:面向前沿模型的研究与评测、用于业务流程的企业 agent 部署,以及 APEX 等用于衡量模型和 agent 在经济价值任务上表现的基准。网站还展示了活跃招聘,以及支持这些服务的大型承包商网络。

核心能力

用于 AI 训练的人类智能

Mercor 表示,其以规模化方式支持前沿研究、RLHF 数据和 AI agent 训练,并使用人类专业知识处理需要领域判断的任务。

工作流发现与 agent 规划

Mercor Enterprise 先收集公司的工作流程和隐性知识,再利用这些输入识别高价值 agent 及其部署路线图。

面向特定公司的 agent 部署

企业版围绕公司自身对高质量工作的定义构建 agent,然后将其部署到工作中,持续学习并不断改进。

agent 与模型基准评测

Mercor Enterprise 包含基准评测,用独立、可重复的评估对 AI 产品进行压力测试,并清晰展示成功与失败模式。

研究与评测基础设施

Mercor Research 产出前沿数据、RL 环境、基准、同行评审研究、评测排行榜、数据集以及开源工具。

基于任务的基准套件

APEX 基准衡量 AI 在专业服务、医疗、软件工程和消费活动等经济价值任务上的表现。

代表性用例

  • 招聘与申请人筛选

    团队可以接入 ATS 数据和岗位评分标准来筛选大量候选人池,然后返回校准后的评分卡和通过/不通过建议,同时让招聘人员参与其中。

  • 站点可靠性与事件响应

    工程或运维团队可以使用该平台检测事件、生成运行手册、识别根因,并在可观测性和事件工具之间缩短缓解时间。

  • 市场研究与综合分析

    咨询、金融和战略团队可以将来自内部和外部研究来源的信息整合为投资论点、竞争研究或市场进入材料。

  • 跨职能 RFP 回复

    销售、法务、合规和 IT 团队可以联合输入来生成 RFP 初稿,而无需在各部门之间手动追问上下文。

  • AI 评测与基准测试

    组织可以通过独立评测对其 AI 产品或 agent 进行基准测试,展示系统在哪些方面表现良好、失效或需要改进。

Pros and Cons

Pros

  • 同时覆盖模型评测和运营部署,使该平台对实验室和企业团队都具有相关性。
  • 使用人类专家和承包商网络来支持领域特定的数据生成、评测和基准测试。
  • 在招聘、软件工程、咨询、金融、销售和业务运营等场景中提供了具体示例。
  • 将基准和研究资产与企业服务结合,有助于把产品工作与可衡量的评测连接起来。

Cons

  • 所提供的定价页面不可用,因此买家无法从来源页面确认定价或套餐结构。
  • 网站仅提供了较高层级的能力描述;所收集到的来源中并未给出详细的产品文档、API 和集成列表。

FAQ

Mercor 是做什么的?

Mercor 似乎专注于 human-in-the-loop 的 AI 工作:前沿研究、RLHF 数据、AI agent 训练,以及围绕公司特定标准构建的企业 AI agent。

Mercor 适合哪些用户?

该网站将 Mercor 定位为面向顶尖 AI 实验室和企业,同时也强调其被研究团队、工程团队,以及招聘、咨询、金融、销售和业务运营团队使用。

Mercor 提供哪些产品或服务?

Enterprise 页面描述的工作流可能包括诊断工作流程、部署 agent、对 AI 产品进行基准评测,以及将企业数据变现。Research 页面则聚焦于前沿数据、RL 环境、基准和评测工具。

Mercor 是否公布定价?

定价页面不可用并返回 404,因此在所提供的来源中,网站未公开定价细节。

Quick Facts

类别
AI 平台
主要用户
AI 实验室、企业和专业承包商
核心领域
前沿研究、RLHF 数据、agent 训练、基准评测和企业 agent
来源域名
mercor.com
定价
提供的定价页面不可用(404)
地点
美国加利福尼亚州旧金山