行业观察

英伟达洽投 AI 训练数据供应商 Mercor,200 亿美元估值刷新数据标注赛道纪录

发布于 2026-08-20
阅读 24
#英伟达#Mercor#训练数据#数据标注#AI数据供应链
英伟达洽投 AI 训练数据供应商 Mercor,200 亿美元估值刷新数据标注赛道纪录

据 The Information 报道,英伟达正洽谈投资成立仅三年的 AI 数据供应商 Mercor,本轮融资投后估值达 200 亿美元,较去年 10 月的 100 亿美元翻倍,General Catalyst 洽谈领投。Mercor 上半年总营收 6.14 亿美元,年化营收率已超 20 亿美元,客户包括 OpenAI、谷歌、Anthropic。英伟达上季度向 Mercor 支付数千万美元采购专家标注数据用于训练开源 Nemotron 模型,并已有专职团队对接英伟达项目。训练数据供应链正在成为 AI 产业竞争的上游卡位点。

据 The Information 报道,英伟达正洽谈投资成立仅三年的 AI 训练数据供应商 Mercor,本轮融资投后估值达 200 亿美元,由现有投资方 General Catalyst 洽谈领投。若交易达成,Mercor 将超越 Scale AI,成为数据标注赛道估值最高的独角兽。

交易与公司事实

  • 估值轨迹:去年 10 月 C 轮融资 3.5 亿美元、估值 100 亿美元;本轮估值直接翻倍。成立至今累计融资约 5.2 亿美元(Benchmark、Felicis 等)。
  • 营收规模:2026 上半年总营收 6.14 亿美元,较 2025 全年增长 70%;截至 6 月年化总营收已突破 20 亿美元。公司将 60%-70% 的总营收支付给外包专家网络。
  • 客户结构:历史上主要收入来自 OpenAI、谷歌、Anthropic 等闭源模型厂商;公司预计 2026 年经营利润 2.26 亿美元。

英伟达的算盘:为 Nemotron 采购专家数据

这桩潜在投资的直接动因是英伟达的开源模型战略。为让 Nemotron 系列对标全球顶级开源模型,英伟达持续向 Mercor 采购法律、金融、科学等领域专家标注的高质量数据——仅上一季度就支付了数千万美元,且 Mercor 已组建几乎全职对接英伟达的专职团队。英伟达披露文件显示,其最新两代 Nemotron 模型均使用了 Mercor 提供的数据。

值得玩味的是训练数据的组合方式:即便在人工标注上持续加码,英伟达训练 Nemotron 仍高度依赖 AI 生成的合成数据,辅以 OpenRouter 平台回收的开发者交互数据。"专家数据精调 + 合成数据打底"正在成为大模型训练的主流配方。

供应链视角:从芯片卡位到数据卡位

把这件事放进产业链坐标看更有意思。英伟达的风险投资正在全面加速——截至 4 月的财季已向私营公司与基建基金投入 186 亿美元,超过 2025 全年,包括对 CoreWeave 和 Nebius 各约 20 亿美元的投资。

但投资 Mercor 的性质不同:这不是向下游客户输血,而是向上游数据供应链卡位。当算力、模型、数据构成 AI 产业三大投入品,芯片巨头亲自下场买数据资产,说明"数据供应链"已被重新定价——不再是人力外包生意,而是模型能力的战略储备。

这对医疗垂直领域有直接映射:通用领域专家数据尚且如此稀缺,医疗数据的获取门槛(隐私合规、专家稀缺、标注复杂度)只高不低。医疗 AI 的专业训练数据,稀缺性与定价权都更甚一筹。Scale AI 被 Meta 入股、Mercor 被英伟达洽购之后,垂直数据服务商的估值逻辑正在被重写。

风险注脚

资本故事之外,Mercor 今年 4 月的数据泄露事件(涉及承包商访谈录音、面部生物识别数据与屏幕截图)已引发至少 7 起集体诉讼——数据供应链的合规与安全成本,同样是这个赛道的底层约束。

上游争夺才刚开始,垂直专业数据是下一站。

千方医数集编辑部 出品

返回医药AI前沿资讯