AI 訓練的人類智慧
Mercor 表示其以規模化方式支援前沿研究、RLHF 資料與 AI agent 訓練,並運用需要領域判斷的任務所需的人類專業知識。
Mercor 是專為前沿研究、human-in-the-loop 訓練資料、企業 agent 與基準驅動評估打造的 AI 平台,服務需要領域專業、任務資料與可衡量 agent 表現的 AI 團隊與企業。
Mercor 是一個專注於為 AI 工作組織人類智慧的平台。從其網站內容可見,它的定位圍繞前沿研究、RLHF 資料、AI agent 訓練,以及以人類專業知識為基礎的企業 AI 系統。
公司的產品範圍涵蓋三大領域:前沿模型的研究與評估、用於商業工作流程的企業 agent 部署,以及像 APEX 這類衡量模型與 agent 在具經濟價值任務上表現的基準測試。網站也顯示其持續招募人才,並有龐大的承包商網絡支援這些服務。
Mercor 表示其以規模化方式支援前沿研究、RLHF 資料與 AI agent 訓練,並運用需要領域判斷的任務所需的人類專業知識。
Mercor Enterprise 先擷取公司工作流程與隱性知識,再利用這些輸入找出高價值 agents 與部署路線圖。
Enterprise 方案會依據公司對高品質工作的定義來打造 agents,接著將其部署到工作流程中,持續學習並改善。
Mercor Enterprise 內建基準測試,以獨立、可重複的評估來壓力測試 AI 產品,並清楚呈現成功與失敗模式。
Mercor Research 產出前沿資料、RL 環境、基準測試、經同行評審的研究、評估排行榜、資料集與開源工具。
APEX 基準測試衡量 AI 在具經濟價值任務上的表現,涵蓋專業服務、醫療、軟體工程與消費者活動。
團隊可匯入 ATS 資料與職位評分準則,以篩選大量應徵者,接著回傳校準後的評分卡與通過/未通過建議,同時讓招募人員保有決策參與。
工程或營運團隊可使用此平台偵測事件、產生 runbooks、找出根本原因,並在可觀測性與事件工具之間縮短緩解時間。
顧問、金融與策略團隊可將內部與外部研究來源的資訊整合為投資論點、競爭研究或市場進入素材。
業務、法務、合規與 IT 團隊可合併各方輸入,產出 RFP 回覆初稿,而無需在部門之間手動追問背景資訊。
組織可使用獨立評估來為其 AI 產品或 agents 進行基準測試,顯示系統在哪些地方表現成功、失敗或需要改進。
Mercor 似乎專注於 human-in-the-loop AI 工作:前沿研究、RLHF 資料、AI agent 訓練,以及依公司特定標準打造的企業 AI agents。
網站將 Mercor 定位為服務頂尖 AI labs 與企業,也強調其可供研究團隊、工程團隊、招聘、顧問、金融、銷售與營運團隊使用。
Enterprise 頁面描述的工作流程可能包含診斷工作流程、部署 agents、對 AI 產品進行基準評估,以及將企業資料變現。Research 頁面則聚焦於前沿資料、RL 環境、基準測試與評估工具。
定價頁目前無法存取且回傳 404,因此網站未在提供的來源中公開定價細節。