数据资产目录 具身智能 · 世界模型 · 多行业数据

高质量、多行业、可商用Conjunto de datos,覆盖AI Coding、Agent评测、DeepResearch、医疗健康、医药、医保、国际语料、具身智能、世界模型等15大领域,助力大模型训练、智能体评测与世界模型研发创新。

110+
数据集总数
15
覆盖领域
34
医疗健康
12
具身智能
6
世界模型

医疗健康 — 新增数据集

影像 · 病历 · 知识图谱
23 个
带授权医学杂志

7万例医学杂志文章,涵盖图文并茂的医学文献、临床病例报告、医学影像配文,附带完整转授权。

体检数据

500万例真实结构化体检数据,性别均衡(男女1:1)、多年龄段分层、体检金额1000元以上人群。

结构化电子病历文本

全量最大的医疗NLP训练语料,5000万例脱敏电子病历,覆盖主诉、现病史、既往史、入院记录、出院小结等。

医学文献/教科书知识库

涵盖医学教科书、临床指南、综述文章、药物说明书等海量权威医学知识内容。

心电图波形图及诊断报告

500万例12导联心电图波形图像及诊断报告,含自动分析报告和医生审核诊断。

皮肤镜图像及病理诊断报告

涵盖皮肤镜图像、皮损临床照片及病理金标准诊断报告。

胸部X光平片及报告

500万例胸部X光平片DICOM影像及结构化诊断报告,双审金标准。

头部CT平扫+增强影像及报告

500万例头部CT平扫+增强DICOM序列影像及诊断报告,涵盖脑梗死、脑出血、颅内肿瘤等。

眼底彩照及诊断报告

高质量眼底彩色照片及结构化诊断报告,基于ICDR国际标准糖尿病视网膜病变分期。

病理全切片数字图像及诊断报告

全切片数字图像(20倍+扫描倍率)及完整病理诊断报告,含免疫组化结果、TNM分期。

内窥镜视频及关键帧报告

500万例内窥镜视频+关键帧截图+诊断报告,含息肉位置/大小/分型。

上腹部癌症数据

500万例上腹部多器官癌症标注,覆盖肝/胆/胰/脾/肾上腺/肾/腹腔淋巴结。

诊断全过程病理

500万例病理诊断全流程图像+文本,覆盖完整诊断链路。

疑难杂症和多学科会诊病例

500万例疑难病MDT会诊文本,罕见病/复杂病AI训练,高难度病例稀缺数据。

连续7次住院以上核心字段病例

100万例慢病纵向追踪结构化数据,连续7+次住院追踪。

混合型肝癌 WSI

500万例Qupath精细区域标注,HCC/ICC/MID/TLS/MVI六类标签。

肝癌/血管瘤数据集

100万例肝脏病变图像标注,肝癌与血管瘤鉴别。

乳腺癌数据

100万例乳腺肿瘤图像标注,乳腺癌AI筛查与诊断。

住院期间全部文书

2000万份住院全周期文本/PDF,涵盖病历质控/DRG/DIP。

NEW 医疗知识图谱数据集

500万+医学实体、2000万+关系三元组,ICD-10/11与SNOMED CT映射,7大知识库。

NEW 医疗NLP训练语料数据集

1亿+条专业医疗NLP标注语料,覆盖实体抽取/对话理解/思维链等12类任务,66个子Conjunto de datos。

NEW 医学影像训练数据集

2000万+医学影像训练样本,CT/MRI/X光/超声/内镜/病理全覆盖,含分类/检测/分割标注。

NEW 专病数据集

300万+专病结构化数据,覆盖糖尿病/脑卒中/肿瘤等26个重点病种队列,5年+长期随访。

医疗健康 — 存量数据集

经典数据集 · 经过验证
11 个
体检数据分析

100万+份深度体检报告,800+结构化医学字段。

临床文本分析

328,000条电子病历、诊断报告、医嘱、文献摘要的NER与关系抽取标注数据集。

皮肤科影像

52,800例DICOM影像及专业医师标注。

肝癌MRI影像

52,800例肝细胞癌多序列MRI DICOM影像及专业医师标注。

通用医学影像

覆盖CT、X-Ray、超声、MRI四大模态的医学影像通用标注数据集。

神经外科

100万+标注手术视频帧,24类解剖结构与手术器械像素级语义分割。

妇产科

百万级妇产科临床数据集,覆盖产前急症、高危妊娠、分娩产后等全孕期场景。

骨科

52,800例DICOM影像及专业医师标注。

中医视觉

100万+例舌面/面部影像及50,000+例专业标注。

超声影像

100万+超声影像标注帧。

腹部影像

100万+DICOM影像切片,覆盖7大器官,薄层CT 512×512+。

AI Coding Conjunto de datos NEW

Post-train · Coding Arena · 仓库级生成 · 长程工程
6 个
ML-Agent(Post-train / MLS-Lite)与 AI4AI
AI4AI · Post-train
定位面向“AI 做 AI 研发”(AI4AI)的后训练数据,对齐 MLE-Bench Lite 榜单口径
任务形式Kaggle 式机器学习竞赛任务:特征工程、模型选型、调参、提交打榜全流程
标注方式获奖方案复现 + 金/银/铜奖牌线标注 + 完整实验轨迹与代码 diff
评估标准奖牌达成率、超越 baseline 幅度、端到端运行成功率(pass@1)
Coding Arena 全栈体感 Task
全栈开发 · 人类偏好
定位对齐 LMArena Coding / WebDev Arena 的全栈开发“体感”偏好数据
任务形式自然语言需求 → 完整 Web 应用(前端+后端+交互样式),双模型匿名对打
标注方式人类偏好成对标注:功能完整性、UI 美观度、交互流畅性三维度
评估标准Elo 评分、对战胜率、标注员间一致性(agreement ≥ 0.75)
NL2Repo 2.0 多语言 Benchmark 标注
仓库级生成 · 6+ 语言
定位自然语言到完整代码仓库的多语言生成基准(Python/Java/Go/TS/Rust/C++)
任务形式需求文档 → 仓库脚手架、模块实现、单元测试与 CI 配置一体化产出
标注方式仓库级 rubric 标注 + 测试用例编写 + 架构合理性评审意见
评估标准构建通过率、测试通过率、模块覆盖率、rubric 综合得分
ProgramBench 难题
竞赛级 · 高难约束
定位竞赛级与研究级高难编程题集:算法、并发、系统编程方向
任务形式多重约束求解:时间/空间/正确性限制下的最优化实现
标注方式多解法标注 + 复杂度证明 + 对抗性边界测试用例构造
评估标准AC 率、pass@k、边界用例覆盖率、解法最优性分级
Ultra Long-horizon Task(FrontierSWE / SWEMarathon)标注
超长程工程 · 马拉松式
定位数小时至数天级超长程软件工程任务,对齐 FrontierSWE、SWE-Marathon 榜单
任务形式大型重构、跨模块特性开发、依赖升级与框架迁移等马拉松式任务
标注方式里程碑分段标注 + 中间状态快照 + 回滚点与关键决策理由记录
评估标准里程碑完成率、端到端解决率、有效上下文保持、人工接管次数
DeepSWE 难题
真实仓库 · 长程修复
定位真实开源仓库长程工程难题,对齐 DeepSWE v1.1(头部模型仅 65–73%)
任务形式多文件联动 issue 修复、隐式依赖梳理、深层回归排查
标注方式失败轨迹归因标注 + 正确 patch + 测试补丁双重验证
评估标准Resolved 率、回归测试通过率、patch 最小化与零破坏变更
查看 AI Coding 数据集板块完整介绍
板块定位 · 数据规模 · 应用场景 · 交付规格 · 示例说明
进入板块

Agent 评测与任务环境 HOT

职业级工作流 · 终端环境 · 工具使用 · 流程自动化
11 个
APEX-Agent
职业级 · 长程工作流
定位对齐 APEX-Agents 的职业级长程任务数据(投行、咨询、法律等)
任务形式跨应用工作流:解析邮件/PDF/表格 → 分析 → 产出专业交付物
标注方式职业专家按交付标准 rubric 评分 + 过程关键动作序列标注
评估标准rubric 加权得分、任务完成度、专业准确性(当前 SOTA < 35%)
Workspace Bench
办公协同 · 多应用
定位办公工作区(文档/表格/邮件/日历/IM)多应用协同任务环境数据
任务形式真实工作区中的信息整合、日程协调、多人协作文档产出任务
标注方式环境状态断言标注 + 产出物质量 rubric 双通道
评估标准状态断言通过率、产出可用性评分、完成步骤效率
JobBench
岗位 SOP · 全流程
定位真实岗位工作职责映射任务集,覆盖运营/财务/HR/客服等 30+ 岗位
任务形式岗位 SOP 任务包:接单 → 处理 → 交付 → 复核全流程执行
标注方式岗位资深从业者标注 SOP 合规点与交付质量分
评估标准SOP 合规率、质量得分、时效达成率
GDPVal
经济价值 · 44 职业
定位对齐 OpenAI GDPval 的经济价值知识工作任务,覆盖 44 个职业
任务形式真实职业交付物制作:分析报告、方案设计、财务建模、演示稿
标注方式行业专家盲评,与人类专业交付物直接对比(win/tie/loss)
评估标准专家盲评胜率、GDPval-AA Elo、经济价值加权分
Agents' Last Exam
55 领域 · 终极考试
定位55 个专业领域长程工作流的“终极考试”级数据,对齐 ALE 榜单
任务形式多阶段专业工作流:调研 → 分析 → 决策 → 交付 → 答辩式追问
标注方式领域专家出题 + 分级评分标准 + 数据污染/泄题检测
评估标准领域加权总分、阶段通过率(当前 SOTA 仅约 53%)
Terminal Bench Science
科学计算 · 终端环境
定位科学计算场景终端任务集,对齐 Terminal-Bench Science 分支
任务形式科研环境搭建、数值实验复现、HPC 作业脚本、数据管线调试
标注方式可执行验证脚本 + 结果数值容差标注 + 环境依赖清单
评估标准任务通过率、结果容差达标率、实验可重复性
Terminal Bench 3 / 4.0
新一代终端 · 远未饱和
定位新一代终端智能体基准数据(TB 3.0 头部模型仅 15–26%,提升空间巨大)
任务形式硬核终端任务:系统调试、内核级排障、多服务编排、安全加固
标注方式Docker 化任务环境构建 + 确定性校验脚本 + 难度分级标定
评估标准pass@1 / pass@3、agent+model 配对得分、任务规范审核通过率
RSI-Exam
递归自我改进
定位递归自我改进(RSI)能力考试:模型优化自身流水线、提示词与工具链
任务形式给定基线系统,多轮迭代提升其在目标 benchmark 上的表现
标注方式改进轨迹全程记录 + 每轮增益归因标注
评估标准相对基线提升幅度、改进收敛轮数、reward hacking 检验
Toolathlon
工具十项全能
定位对齐 Toolathlon 的工具使用十项全能数据(当前 SOTA 约 58%)
任务形式跨 10 类工具场景的选型、串联、容错与回退任务
标注方式工具调用序列金标准 + 容错分支标注 + 参数正确性校验
评估标准端到端成功率、调用准确率、冗余调用率、异常恢复成功率
AutomationBench
业务流程 · 端到端
定位端到端企业业务流程自动化基准数据(头部模型仅 18–30%)
任务形式真实企业流程:审批、对账、入库、报表、跨系统数据同步
标注方式流程节点断言 + 业务规则合规标注 + 异常分支全覆盖
评估标准流程完成率、规则合规率、异常处理正确率
Skills 高质量困难环境
长尾知识 · 复杂 Pattern
定位长尾边界知识与多轮复杂 pattern 的高质量 Skill 环境数据
任务形式冷门领域知识调用 + 多轮隐含 pattern 发现、归纳与迁移应用
标注方式领域专家挖掘长尾知识 + pattern 规则形式化 + 干扰项设计
评估标准长尾知识命中率、pattern 迁移成功率、抗干扰准确率
查看 Agent 评测与任务环境板块完整介绍
11 类任务环境 · 职业工作流 · 终端与工具 · 交付规格
进入板块

DeepResearch 与高难度专家标注 NEW

深度调研 · 报告标注 · 硕博级数学
4 个
开放域复杂 DeepResearch 任务
多跳调研 · 开放域
定位开放域多跳深度调研任务,对齐 BrowseComp / DeepResearch 类榜单
任务形式模糊开放问题 → 多源检索、交叉验证、长链路推理得出结论
标注方式问题构造(答案唯一、路径隐蔽)+ 检索证据链全程标注
评估标准答案准确率、证据链完整性、检索效率、引用正确率
中文高价值 DeepResearch 调研任务
中文信源 · 高价值
定位中文互联网高价值深度调研任务:产业、政策、学术、商业情报
任务形式中文多源(官网/研报/数据库/政策文件)调研与综述产出
标注方式领域专家标注权威信源 + 事实性核验 + 信息时效性分级
评估标准事实准确率、信源权威度、覆盖完备性、时效合规率
高质量报告标注
全监督信号 · 证据链
定位带完整监督信号的研究报告标注数据(reference answer + 证据链)
任务形式报告要素标注:reference answer、关键证据链、引用来源、检索路径、reasoning trace
标注方式双审标注 + 证据-结论映射校验 + 推理轨迹分段核验
评估标准要素完整率、证据支撑率、轨迹可复现性、双审一致性
大学/博士级高难度数学题及专家标注
硕博级 · 严格证明
定位本科高年级至博士级数学题数据,对齐 GPQA / FrontierMath 难度带
任务形式证明题、竞赛题、研究级开放问题(代数/分析/拓扑/概率/组合)
标注方式数学专业硕博标注多路径解答 + 证明严格性评审 + 难度分级
评估标准解答正确率、证明严谨性评分、步骤完整性、专家复核通过率
查看 DeepResearch 与专家标注板块完整介绍
深度调研 · 报告五要素标注 · 硕博级数学 · 交付规格
进入板块

具身智能数据集 HOT

机器人模仿学习 · 世界模型训练 · 跨本体统一数据
12 个

Para responder a las necesidades de vanguardia de 2026 en IA encarnada y modelos del mundo, ofrecemos datos de alta calidad en múltiples escenarios: comportamiento egocéntrico, imitación mediante robot humanoide, evaluación de modelos del mundo, unificación multicuerpo, simulación bimanual, control táctil de fuerza, montaje industrial, comercio minorista, clasificación logística, servicios domésticos, documentos de oficina y restauración, con entrega en formato LeRobot 3.0 y metadatos JSON。

EgoSuite 第一视角人类行为数据集
RGB-D IMU 200Hz FOV 160°
100,000+ 小时 1920×1080

覆盖日常生活、厨房、办公与零售场景的第一视角长视频,配合头部IMU、凝视点与手部关键点标注。适用于VLA模型预训练、Ego4D/EgoSuite类任务与以人为中心的世界模型。

AGIBOT WORLD 人形机器人模仿数据集
Stereo RGB-D Proprioception Force
10,000+ episodes 1920×1080

真实人形机器人在家庭与办公场景中的双臂操作轨迹,包含立体广角RGB-D、本体感知、腕部六维力与末端执行器状态。适配LeRobot 3.0,支持ACT/Diffusion Policy微调。

GigaWorld-1 世界模型评测数据集
RGB-D LiDAR 30 FPS
50,000+ clips 1920×1080

面向生成式世界模型的大规模评测基准,涵盖动态场景物理一致性、可交互物体轨迹预测、相机视点变换与长期 rollout 稳定性测试。含JSON元数据与真值标注。

ARIO 跨本体统一机器人数据集
Multi-embodiment Unified Action Cross-Domain
5,000+ tasks ≥1080P

整合单臂、双臂、移动机械臂与多指灵巧手等多种本体形态,统一动作空间与坐标系,支持跨本体迁移学习与通用机器人策略训练。附相机标定与去畸变参数。

RoboTwin 2.0 双臂协同仿真数据集
Synthetic RGB-D Bimanual Domain Random
100,000+ pairs 1920×1080

高保真仿真环境中生成的双臂协同操作数据,覆盖装配、搬运、折叠与协作任务,配备深度、实例分割与物理接触标签,支持sim-to-real迁移与域随机化训练。

触觉/力控精细操作数据集
Tactile Force/Torque Macro+Micro
8,000+ episodes 1920×1080

插拔、旋转、抓取易碎与可形变物体的精细操作数据,同步记录GelSight触觉图像、腕部六维力矩、高频关节力控与双目近景视频,适用于力位混合控制策略学习。

工业装配与维护数据集
Stereo RGB Force Tool Use
15,000+ episodes 1920×1080

真实工厂场景下的螺丝拧紧、插件、线缆整理与设备点检任务,提供多视角立体视频、工具位姿、扭矩曲线与维护SOP文本对齐,支持工业质检与预测性维护模型。

商业零售与补货数据集
RGB-D SKU Vision 30 FPS
12,000+ episodes 1920×1080

超市与便利店货架拣选、补货与盘点操作数据,包含SKU视觉识别、货架状态变化、扫码动作与库存记录,适用于零售机器人和无人店运营决策模型。

物流拣选与分拣数据集
RGB-D Parcel Poses High Speed
20,000+ episodes 1920×1080

仓储物流场景中的快递包裹抓取、码垛、分拣与异形件处理,提供包裹6D位姿、传送带运动、纸箱尺寸与破损标签,支持物流自动化与抓取规划算法训练。

家庭服务与清洁数据集
Bare-hand Cleaning Home
10,000+ episodes 1920×1080

家庭环境中的扫地、擦拭、整理、垃圾分类与物品归位任务,采用裸手视频与穿戴式相机采集,覆盖多户型、光照与家庭成员干扰,适用于家庭服务机器人。

办公文档处理数据集
RGB-D Document Stamp
8,000+ episodes 1920×1080

办公场景中的文件打印、盖章、扫描、分类归档与票据整理操作,同步记录文档OCR结果、操作步骤与审批状态,适用于办公自动化数字员工训练。

餐饮服务与后厨数据集
RGB-D Food Safety
6,000+ episodes 1920×1080

餐厅前厅接待、点餐、传菜与后厨备餐、清洁、餐具回收等任务,涵盖食物状态变化、服务礼仪流程与食品安全Cumplimiento动作,支持餐饮服务机器人与人机协作系统。

医药NEW

临床试验 · 药物 · 中药
6 个

全新上线,覆盖药品结构化数据、中药方剂与医疗器械耗材三大医药数据资产。

NEW 药品结构化数据集

500万+条中国药品数据,15+核心维度,ATC Nivel 5全覆盖,支持合理用药AI与药物警戒。

NEW 中药与方剂数据集

200万+条中药、方剂与自制剂数据,涵盖性味归经、功效分类、方剂组成、道地产区。

NEW 医疗器械与耗材数据集

1 M+条医疗器械注册与耗材数据,覆盖注册证编号、管理类别、适用范围、技术参数。

药品临床应用数据集
真实世界用药记录、处方分析、用药频次与疗程数据。
即将上线
药品不良反应监测数据集
自发呈报系统ADR报告、信号挖掘数据集。
即将上线
药物临床试验数据集
CDE登记临床试验、BE试验、真实世界研究RWE数据。
即将上线

医保NEW

DIP/DRG · 支付 · 目录
4 个

全新上线,覆盖医保结算清单、DIP病种分组、DRG分组编码与医保支付标准数据。

NEW 医保结算与 DIP/DRG 数据集

1000万+条医保结算清单与支付数据,14+核心维度,覆盖医保目录/DIP分组/DRG编码/费用构成。

医保目录全量数据集
药品/诊疗/耗材三大目录,含YB编码、支付标准与限制范围。
即将上线
DIP分值库
按病种分值付费DIP分组编码、分值、结算点值全覆盖。
即将上线
DRG权费数据集
CHS-DRG 1.2版分组、相对权重(RW)、费率与基准点数据。
即将上线

国际语料NEW

多语种 · 医学翻译 · 跨语言
1 个

全新上线,覆盖10语种500万+条多语种医疗语料,支持医学NMT与跨语言知识图谱构建。

NEW 国际医疗语料数据集

500万+条多语种医疗语料,10语种、8大类型、ICD-11/SNOMED-CT术语标注,S/A级翻译质量。

产业经济

宏观 · 行业 · 企业
5 个
CAD图纸数据

多行业CAD二维/三维图纸数据,适用于图识理解、BIM转换与工业大模型训练。

合同数据

覆盖买卖、租赁、服务、劳动等多类型合同文本,支持合同审查与风险识别模型。

金融数据

企业财务、行业研报、投融资事件等结构化数据,适用于金融风控与产业分析。

供应链数据

供应商关系、采购订单、物流节点与库存数据,支持供应链优化与风险预警。

民生

人口 · 就业 · 社保
3 个
房票/安置数据

房屋征收、房票发放与安置补偿结构化数据,支持城市更新与民生决策分析。

征地数据

土地征收范围、补偿标准、权属信息与审批流程数据,适用于土地管理与合规审计。

智慧城市数据

城市运行体征、网格事件与公共服务数据,支持城市治理大模型与智慧决策。

AI+科学家

科研 · 文献 · 知识图谱
6 个
大学以上高质量理科题目

覆盖数学、物理、化学、计算机等学科高难度题目与详细解答,适用于推理模型训练。

高质量题库

多学科标准化试题与解析,支持智能出题、错题诊断与个性化学习模型。

考试数据

历年真题、模拟卷与考生作答数据,适用于教育评估与智能阅卷算法研发。

论文数据

学术文献摘要、引用关系与关键词标注,支持文献检索、综述生成与科研知识图谱。

科技AI数据

科技政策、专利、技术标准与产业动态数据,支持科技情报分析与AI4S应用。

HLE 人类最后考试

高难度多学科专家级问题与答案,用于评估大模型推理能力与知识边界。

AI+安全

红队 · 安全评估 · 对齐
8 个
攻击行为训练数据集

覆盖网络攻击、社会工程与提示注入等攻击样本,支持红队测试与安全对齐训练。

检测能力缺口分析数据集

安全模型检测边界与误报案例分析,帮助识别防御盲区与提升鲁棒性。

缓冲区溢出数据集

C/C++缓冲区溢出漏洞代码与触发输入样本,支持二进制安全与静态分析模型训练。

路径穿越数据集

路径穿越与目录遍历攻击Payload集合,覆盖多种编码绕过形式,用于文件操作安全检测。

综合威胁检测数据集

多源日志、流量与告警关联样本,支持SOC智能研判与ATT&CK技战术识别模型。

文化艺术

艺术 · 文化 · 创意
1 个
古文书画金石甲骨文书法

古籍、书法、篆刻、甲骨文与金石拓片高清图像及释文标注,支持文化遗产数字化与书法生成模型。

世界模型

仿真 · 环境 · 具身 · 空间数据
6 个
照片建模数据集

多视角物体与场景照片集合,配套相机位姿、内参与稀疏重建结果,支持NeRF/3DGS/Gaussian Splatting重建与世界模型训练。

无人机建模数据集

无人机航拍正射与倾斜摄影数据,包含POS、RTK坐标、云台角度与大范围场景Mesh,适用于城市级三维重建与仿真环境构建。

激光点云建模数据集

车载/机载/地面站LiDAR扫描点云,含回波强度、语义类别与轨迹信息,支持高精地图、数字孪生与自动驾驶世界模型。

照片→模型高质量数据集

输入照片与对应高质量三维模型、纹理与材质配对数据,支持图像到3D生成、单目重建与AIGC 3D内容生产。

园区/校园/工厂/古建/城市高精

园区、校园、工厂、古建筑与城市街区的高精三维场景数据,包含语义分割、实例标注与可交互对象,支持数字孪生与仿真训练。

三维模型拆分数据集

复杂三维模型按功能、结构与装配关系拆分的训练数据,包含部件级语义、装配顺序与约束关系,支持可拆装数字孪生与机器人装配规划。

需要更多行业数据集?定制你的专属数据方案

90+标准Conjunto de datos已上线,覆盖医疗、医药、医保、具身智能、世界模型、法律等12大行业。如需定制化数据采集与标注服务,我们的专家团队将为您提供一对一咨询。

Data Partnership

需要更多行业数据集

DataAssetsAPI 持续扩充Activos de datos目录,支持按行业、维度、质量等级定制化交付。Contáctenos的数据专家获取完整目录与报价方案。

90+
高质量数据集
12
大行业覆盖
5000万+
标注样本

合规数据 · 定制交付 · 专业技术支持