行业观察

徐汇入列32城标注试点:医疗健康的「数据用工」有了城市级样本

发布于 2026-08-31
阅读 10
#["数据标注"#"医疗健康"#"数据要素"#"先行先试"]
徐汇入列32城标注试点:医疗健康的「数据用工」有了城市级样本

徐汇区跻身国家第二批32城数据标注先行先试,聚焦医疗健康,部署预标注、智能质检、隐私计算等技术栈,打造医疗数据集供给枢纽。

第二批先行先试:徐汇聚焦医疗健康的信号

在2026数博会上,国家数据局公布第二批数据标注先行先试布局名单,徐汇区跻身全国32个第二批建设行列,且明确聚焦医疗健康领域数据标注工作。加上此前成都、合肥等7城,全国将有39个城市开展数据标注先行先试。

徐汇被选中不是偶然。它兼具优质临床资源与AI产业集聚优势:多家三甲医院、国家人工智能应用(医疗)中试基地,形成了多层次临床数据供给体系。把「临床+AI」的融合优势交给一个区级行政单元去落地,本身就是一次制度层面的实验。

四大瓶颈:标注标准、智能化、人才、合规

官方披露的痛点清单很具体:行业标注标准缺失、智能化程度不足、医工复合人才紧缺、敏感医疗数据合规流通难。这四个问题,几乎覆盖了医疗数据标注产业化的全部难点。

值得注意的措辞是「推动数据标注模式向人机协同、专家深度参与转型」。这意味着医疗标注不能照搬通用CV/NLP的众包模式——一张影像的标注需要执业医师级别的判断,一份病历需要懂临床术语的标注员。专家深度参与,是医疗标注区别于通用标注的本质。

专项行动:从预标注到隐私计算的技术栈

徐汇部署的是一套完整技术栈:突破医疗预标注、智能质检、隐私可控数据合成等关键技术,迭代隐私计算基础设施,构建人机协同、专家深度参与的新型标注模式。

这套动作的逻辑是「合规前置」——医疗数据标注的技术路线,必须把隐私计算、数据脱敏、合规流通做在前面,而不是事后补救。这恰好回应了医疗数据「不敢用」的核心顾虑:只有技术层面能保证「数据不出域、可用不可见」,标注产业才可能规模化。

从城市样本到可复制模式:数据用工的结构性变化

徐汇试点的最终目标是「可复制、可推广的实践样板」。它要打造的不仅是数据,而是四个枢纽:全国医疗高质量数据集供给枢纽、智能标注技术策源地、标注标准创制高地、医工融合人才样板。

对行业的意义在于:医疗数据的「数据用工」正在从分散的外包标注,走向城市级的专业化基地。当标注标准、人才、合规、技术在一个行政单元内被系统性地补齐,高质量医疗数据集的供给才可能从「实验室手工作坊」升级为「城市级工厂」。

对医疗AI企业而言,徐汇试点的意义在于「确定性的供给侧改善」:过去做医疗数据,企业要自己解决标注、合规、人才的全部环节,成本高、周期长、风险大。城市级试点一旦跑通,意味着这些基础设施可以被「按需调用」,企业的精力可以重新聚焦到模型和产品本身。这正是「数据要素市场化」最朴素的产业价值——把数据生产的重资产,变成可复用的公共服务。


千方医数集编辑部 出品

返回医药AI前沿资讯