即取即用的 AI-Ready 医疗数据集库

千方医数集致力于为医疗 AI 研究人员找到合适的数据集,让你的 AI 感知模型能够更快地学习、更准确地运行,并无缝适应现实世界的环境。

数据标签

医学影像 AI-Ready 数据集

电子病历与文本数据集

病灶分割与标注数据集

共 219 个数据集

Open-PMC-18M | 生物医学多模态视觉-语言数据集 | 千方医数集
多模态视觉-语言文献挖掘图像-文本对

Open-PMC-18M | 生物医学多模态视觉-语言数据集 | 千方医数集

约 1800 万对图文对放射学显微镜VLP 三模态PMC 来源文献来源数据集
PDB 蛋白质数据银行 | 千方医数集
蛋白质结构结构生物学药物发现分子对接

PDB 蛋白质数据银行 | 千方医数集

约21万+结构约500GB压缩X-raycryo-EMNMR分子级数据
GEO 基因表达综合数据库 | 千方医数集
转录组学功能基因组学公共数据库

GEO 基因表达综合数据库 | 千方医数集

约 200TB+ 数据量650 万+ 样本20 万+ 研究650 万+ 样本
ENCODE — DNA 元素百科全书 AI-Ready Wikipedia | 千方医数集
功能基因组学表观基因组基因调控多组学

ENCODE — DNA 元素百科全书 AI-Ready Wikipedia | 千方医数集

23,000+ 功能基因组学实验2,373,014 人类 cCRE1.3 PB 数据总量人类与小鼠基因组
1000 Genomes Project — 千人基因组计划全球遗传变异图谱 | 千方医数集
群体遗传学全基因组测序GWAS基因型填补生物信息学

1000 Genomes Project — 千人基因组计划全球遗传变异图谱 | 千方医数集

VCF分阶段单倍型GRCh37GRCh38开放获取2,504 人 (Phase 3), 3,202 人 (2022 30×)
CZ CELLxGENE — 单细胞转录组标准化数据平台 | 千方医数集
单细胞组学转录组学scRNA-seq空间转录组AI 预训练

CZ CELLxGENE — 单细胞转录组标准化数据平台 | 千方医数集

H5AD AnnDataTileDB-SOMA约 17,651 名人类供体
UniProt — Universal Protein Resource 通用蛋白质资源 | 千方医数集
蛋白质组学生物信息学序列数据库功能注释AI 基础数据

UniProt — Universal Protein Resource 通用蛋白质资源 | 千方医数集

FASTAXMLRDFUniRef50/90/100蛋白质序列与功能数据库
MoNuSeg — 多器官细胞核分割基准数据集 | 千方医数集
计算病理学细胞核分割H&E实例分割多器官基准数据集

MoNuSeg — 多器官细胞核分割基准数据集 | 千方医数集

显微镜图像TIFXML 标注TCGA 来源约 97 MB44 张图像(来自约 44 名独特患者)
BCNB (早期乳腺癌芯针活检) — 计算病理多示例学习数据集 | 千方医数集
数字病理乳腺癌多示例学习全切片图像腋窝淋巴结芯针穿刺

BCNB (早期乳腺癌芯针活检) — 计算病理多示例学习数据集 | 千方医数集

1058 名患者约 33 GBJPG WSI13 项临床特征1058 名
TCGA 癌症基因组图谱 AI-Ready 数据集 | 千方医数集
多组学数据基因组学转录组学表观组学蛋白质组学

TCGA 癌症基因组图谱 AI-Ready 数据集 | 千方医数集

约 2.5 PB 规模约 20000 个样本33 种癌症类型7 种分子表征平台11000+ 名患者11,000+ 名患者
BraTS 脑肿瘤分割挑战赛 AI-Ready 数据集 | 千方医数集
MRI 影像脑肿瘤语义分割挑战赛基准

BraTS 脑肿瘤分割挑战赛 AI-Ready 数据集 | 千方医数集

约 4,500+ 病例约 200 GB 大小4 模态 MRI80+ 机构4,500+
MedPix — NLM 放射影像教学数据库 AI-Ready Wikipedia | 千方医数集
多模态医学教育CT影像MRI影像

MedPix — NLM 放射影像教学数据库 AI-Ready Wikipedia | 千方医数集

约 5.9 万张图像约 1.2 万病例约 322 MB (MedPix-2.0)约 1.2 万人 / 2,050 例

定制数据集服务

无法找到所需数据?我们提供个性化的临床数据采集与高精度人工标注服务,满足您的特定算法研发需求。