DeepResearch 与高难度专家标注

DeepResearch 与高难度专家标注 NEW

开放域深度调研 · 中文高价值信源 · 全监督报告标注 · 硕博级数学

面向深度研究(DeepResearch)与高难度推理场景,提供四类高质量标注数据:开放域多跳调研、中文高价值调研、带完整监督信号的研究报告标注,以及本科高年级至博士级数学题专家标注。所有标注均由领域专家与硕博团队执行,证据可追溯、结论可核验。

数据集目录

板块定位与建设价值

证据可追溯

每条结论均配套证据链、引用来源与检索路径,训练出的模型“有据可依”、便于审计。

全监督信号

报告类数据同时提供 reference answer、证据链、引用、检索路径与 reasoning trace 五类信号。

专家级门槛

数学与专业领域由硕博团队标注并复核,难度对齐 GPQA / FrontierMath 区间。

中文场景补强

专门建设中文权威信源调研数据,补齐中文 DeepResearch 训练与评测短板。

数据与任务构成、规模说明

任务规模

调研类 2,000–10,000 题;报告标注 3,000–8,000 篇;数学题 5,000–20,000 题,支持定制扩容。

信源范围

官网、监管文件、研报、学术库、行业数据库等多类中文权威信源,标注权威度与时效等级。

标注粒度

问题级、证据级、句子级三层标注;数学题提供多路径解答与严格性评审。

难度分布

数学类难度对齐 GPQA / FrontierMath 区间;调研类按推理跳数与信源稀缺度分级。

典型应用场景

DeepResearch 产品训练

为调研型 Agent 提供从检索到成文的全链路监督信号。

推理轨迹蒸馏

以 reasoning trace 作为蒸馏源,提升小模型的长链推理能力。

数学推理突破

支撑数学推理模型在竞赛与研究生级题目上的能力上限突破。

可信与可解释研究

基于证据链与引用标注研究模型幻觉来源与可解释性。

交付形式与规格参数

交付格式

JSON/JSONL 结构化数据 + 报告原文(Markdown/PDF)+ 数学题 LaTeX + 标注明细表。

核心字段

task_id、question、reference_answer、evidence_chain、citations、retrieval_path、reasoning_trace、difficulty。

质检标准

双审 + 事实性核验 + 专家复核;数学类附证明严格性评分,报告类要素完整率 ≥ 98%。

交付周期

标准品类 4–6 周;数学与专业报告类 6–8 周;支持分批交付。

授权与合规

商业使用授权 + 信源合规说明 + 个人信息脱敏处理。

示例说明

报告标注五要素结构(节选)
{
  "task_id": "report-01135",
  "question": "2026 年国内医疗影像 AI 三类证获批情况",
  "reference_answer": "截至 2026Q2,共 N 张三类证…",
  "evidence_chain": [
    {"claim": "2026Q2 新增 7 张", "source": "NMPA 公告", "quote": "…"},
    {"claim": "胸腔 CT 占比最高", "source": "行业研报", "quote": "…"}
  ],
  "retrieval_path": ["NMPA 数据库 → 分类筛选 → 导出", "研报库 → 关键词检索"],
  "reasoning_trace": ["确认口径", "交叉验证", "汇总成表"]
}
数学题标注结构(节选)
{
  "task_id": "math-04211",
  "level": "PhD",
  "field": "代数几何",
  "statement": "设 X 为光滑射影曲面,证明…",
  "solutions": [
    {"path": "层论路线", "steps": 12, "rigor": 5},
    {"path": "上同调路线", "steps": 9, "rigor": 4}
  ],
  "review": {"correctness": true, "gap_found": "步骤 7 需补充紧性论证"}
}

需要定制化的 DeepResearch 与专家标注数据?

长沙朗慧信息科技有限公司 DataAssetsAPI 平台,支持按领域、难度带、信源类型与标注粒度灵活组合,提供样例预览与专家团队对接。

立即咨询