行业,项目代码 2605-440106-04-04-169182,立项类型为备案,建设性质为
,所属地区为广东省-广州市-天河区。项目总投资7500万,预计
开工,
竣工,建设规模及内容包括多模态数据集规模:60,000例(≥4种模态且数据完整度≥60%,与数据集建设规模直接对应)
原始数据总规模:502000例
预训练数据集:≥1,000亿Token(预计~1,200亿Token)
国内首个消化道疾病领域高质量多模态数据集,覆盖结直肠癌、胃癌、食管癌、IBD等15大病种,构建≥4种模态(影像、病理、基因组、临床文本)。建设内容:①数据汇聚与治理(汇聚院内502000例+12家外部机构);②平台建设(5大功能模块、22个工具链);③算力基础设施(华为昇腾AI集群);④安全体系(隐私计算、区块链溯源);⑤人才队伍建设。。该项目于2026-05-08经广州市天河区发展和改革局审批办结(通过)。注册后免费查看项目建设地点及业主信息。| 所属行业 | -- | 项目代码 | 2605-440106-04-04-169182 |
| 申报时间 | -- | 立项类型 | 备案 |
| 所属地区 | 广东省-广州市-天河区 | 建设地点 | 注册后免费查看 > |
| 项目总投资(万) | 7500 | 资金来源 | -- |
| 建设性质 | -- | 建设年限 | 2026-07-01~2028-06-01 |
| 主要建设规模/内容 | 多模态数据集规模:60,000例(≥4种模态且数据完整度≥60%,与数据集建设规模直接对应) 原始数据总规模:502000例 预训练数据集:≥1,000亿Token(预计~1,200亿Token) 国内首个消化道疾病领域高质量多模态数据集,覆盖结直肠癌、胃癌、食管癌、IBD等15大病种,构建≥4种模态(影像、病理、基因组、临床文本)。建设内容:①数据汇聚与治理(汇聚院内502000例+12家外部机构);②平台建设(5大功能模块、22个工具链);③算力基础设施(华为昇腾AI集群);④安全体系(隐私计算、区块链溯源);⑤人才队伍建设。 | ||
| 相关办理结果 |
| ||||||||||