返回首页





详细介绍
Mercor 官网首页只有一句定位:Mercor is organizing human intelligence to power the AI economy.,副标题写明正在为顶尖 AI 实验室与企业规模化提供前沿研究、AI 基准与智能体训练支持。它的形态很特别——不是传统 SaaS,而是把专家当成供给侧资源组织起来:个人在官网看到按小时标价、按专业方向发布的角色并申请,机构则购买这些人类产出的数据与评测能力。官网上同时挂着 Research、Enterprise、Experts 三条线,Experts 面向接单方,Enterprise 面向采购方,Research 是它自建的基准体系。
核心能力
- 专家岗位市场:官网设有 Latest roles 板块,示例角色包括门诊与社区医疗洞察调研(标价 $90)、数据科学专家($100–150/hr)、应用物理基准专家($61–77/hr)等。
- APEX 基准体系:官网称 APEX 系列用于评估前沿模型在专业服务、医学与软件工程上能否完成有经济价值的任务,包含 APEX-Agents、APEX-Accounting(标注与 Ramp 合作)与 APEX-SWE。
- Human data & evals:官网写明拥有 30k+ 专家(医生、律师、工程师、顾问),基准与强化学习环境建立在真实专业工作之上,并提供前沿实验室依赖的人工评估。
- Data monetization:官网称可自动匿名化遮蔽 60 多类别的数据,把企业既有工作流数据变成新的收入来源。
- 四条路径:官网把产品归纳为 Find work、Evaluate AI、Build evals、Deploy agents。
适合谁
- 有专业资质的个人——医生、律师、工程师、财会、顾问——想在官网列出的专家岗位里接单,Expert 板块标注平均签约时薪为 $109。
- 需要高质量人类数据与评测集的 AI 实验室。
- 想把行业经验沉淀成 AI 能力的企业团队,这条线包含基准构建与人工评估。
- 手上已有业务流程数据、希望合规变现的企业。
使用建议
- 先明确自己在哪一侧:接单看 Experts 与 Latest roles,采购与研究看 Enterprise 与 Research,两套流程完全不同。
- 官网上标注的时薪与录用人数是动态数据,面试与申请条件以官网当次列出的角色说明为准,不要按平均值预期收益。
- 把企业工作流数据交给第三方前,务必先看官网关于匿名化范围与数据保留的说明;官网提到自动遮蔽 60 多类别,但敏感字段是否覆盖到位需要自行核对。
- 官网 Journal 中的融资与估值信息属公司自行发布,可作背景参考但不构成投资依据;条款与数据政策以官网最新说明为准。
相似工具

OpenDataLab
上海人工智能实验室推出的开放数据平台,官方称面向国产大模型提供高质量开源数据集,支持数据集检索与下载,并配套数据标注与治理工具及开源社区能力。
同标签 · 数据标注

Arena
众包模式的 AI 模型竞技场,两个模型匿名对战由用户投票分胜负,并据此生成 LLM、图像与代码模型的公开排行榜,内置落地页、仪表盘、小游戏等任务模板可直接实测。
同标签 · 模型评测

PromptPilot
火山引擎推出的提示词工程平台,官方称覆盖提示词生成、调试与批量评估,支持文本理解、视觉理解与多轮对话等场景,可上传任务数据自动优化提示词并通过 API 调用。
同标签 · 模型评测

Roboflow
面向开发者与企业的计算机视觉平台,覆盖数据管理、标注、训练到云端与边缘部署,官方称超 100 万工程师在用,配套 Inference、supervision 等开源库。
同标签 · 数据标注

影刀AI Power
同分类

SEAL LLM Leaderboard
Scale AI 旗下 Labs 出品的专家驱动评测榜单,覆盖智能体编程、前沿推理与安全对齐等 20 多个基准、100 多个模型,可按能力维度分档浏览并持续更新。
内容相近

