Mercor logo

Mercor

認領

Mercor 是專為前沿研究、human-in-the-loop 訓練資料、企業 agent 與基準驅動評估打造的 AI 平台,服務需要領域專業、任務資料與可衡量 agent 表現的 AI 團隊與企業。

Mercor preview

概覽

Mercor 是一個專注於為 AI 工作組織人類智慧的平台。從其網站內容可見,它的定位圍繞前沿研究、RLHF 資料、AI agent 訓練,以及以人類專業知識為基礎的企業 AI 系統。

公司的產品範圍涵蓋三大領域:前沿模型的研究與評估、用於商業工作流程的企業 agent 部署,以及像 APEX 這類衡量模型與 agent 在具經濟價值任務上表現的基準測試。網站也顯示其持續招募人才,並有龐大的承包商網絡支援這些服務。

核心功能

AI 訓練的人類智慧

Mercor 表示其以規模化方式支援前沿研究、RLHF 資料與 AI agent 訓練,並運用需要領域判斷的任務所需的人類專業知識。

工作流程發現與 agent 規劃

Mercor Enterprise 先擷取公司工作流程與隱性知識,再利用這些輸入找出高價值 agents 與部署路線圖。

公司專屬的 agent 部署

Enterprise 方案會依據公司對高品質工作的定義來打造 agents,接著將其部署到工作流程中,持續學習並改善。

agent 與模型基準評測

Mercor Enterprise 內建基準測試,以獨立、可重複的評估來壓力測試 AI 產品,並清楚呈現成功與失敗模式。

研究與評估基礎設施

Mercor Research 產出前沿資料、RL 環境、基準測試、經同行評審的研究、評估排行榜、資料集與開源工具。

以任務為基礎的基準測試套件

APEX 基準測試衡量 AI 在具經濟價值任務上的表現,涵蓋專業服務、醫療、軟體工程與消費者活動。

代表性使用案例

  • 招募與應徵者篩選

    團隊可匯入 ATS 資料與職位評分準則,以篩選大量應徵者,接著回傳校準後的評分卡與通過/未通過建議,同時讓招募人員保有決策參與。

  • 網站可靠性與事件回應

    工程或營運團隊可使用此平台偵測事件、產生 runbooks、找出根本原因,並在可觀測性與事件工具之間縮短緩解時間。

  • 市場研究與整合

    顧問、金融與策略團隊可將內部與外部研究來源的資訊整合為投資論點、競爭研究或市場進入素材。

  • 跨部門 RFP 回覆

    業務、法務、合規與 IT 團隊可合併各方輸入,產出 RFP 回覆初稿,而無需在部門之間手動追問背景資訊。

  • AI 評估與基準測試

    組織可使用獨立評估來為其 AI 產品或 agents 進行基準測試,顯示系統在哪些地方表現成功、失敗或需要改進。

Pros and Cons

Pros

  • 同時涵蓋模型評估與營運部署,使平台對實驗室與企業團隊都具相關性。
  • 使用人類專家與承包商網絡支援領域特定資料產製、評估與基準測試。
  • 提供跨招聘、軟體工程、顧問、金融、銷售與商業營運的具體應用範例。
  • 將基準與研究資產與企業服務並列,有助於把產品工作與可衡量的評估連結起來。

Cons

  • 所提供的定價頁無法存取,因此買家無法從來源頁面確認價格或方案結構。
  • 網站僅提供功能的高層次描述;在蒐集到的來源中,未提供詳細產品文件、API 或整合清單。

FAQ

Mercor 是做什麼的?

Mercor 似乎專注於 human-in-the-loop AI 工作:前沿研究、RLHF 資料、AI agent 訓練,以及依公司特定標準打造的企業 AI agents。

Mercor 適合哪些人?

網站將 Mercor 定位為服務頂尖 AI labs 與企業,也強調其可供研究團隊、工程團隊、招聘、顧問、金融、銷售與營運團隊使用。

Mercor 提供哪些產品或服務?

Enterprise 頁面描述的工作流程可能包含診斷工作流程、部署 agents、對 AI 產品進行基準評估,以及將企業資料變現。Research 頁面則聚焦於前沿資料、RL 環境、基準測試與評估工具。

Mercor 有公開定價嗎?

定價頁目前無法存取且回傳 404,因此網站未在提供的來源中公開定價細節。

Quick Facts

類別
AI 平台
主要使用者
AI labs、企業與專家承包商
核心領域
前沿研究、RLHF 資料、agent 訓練、基準測試與企業 agents
來源網域
mercor.com
定價
提供的定價頁不可用(404)
地點
加州舊金山