DeepResearch 与高难度专家标注 NEW
开放域深度调研 · 中文高价值信源 · 全监督报告标注 · 硕博级数学
面向深度研究(DeepResearch)与高难度推理场景,提供四类高质量标注数据:开放域多跳调研、中文高价值调研、带完整监督信号的研究报告标注,以及本科高年级至博士级数学题专家标注。所有标注均由领域专家与硕博团队执行,证据可追溯、结论可核验。
开放域深度调研 · 中文高价值信源 · 全监督报告标注 · 硕博级数学
面向深度研究(DeepResearch)与高难度推理场景,提供四类高质量标注数据:开放域多跳调研、中文高价值调研、带完整监督信号的研究报告标注,以及本科高年级至博士级数学题专家标注。所有标注均由领域专家与硕博团队执行,证据可追溯、结论可核验。
每条结论均配套证据链、引用来源与检索路径,训练出的模型“有据可依”、便于审计。
报告类数据同时提供 reference answer、证据链、引用、检索路径与 reasoning trace 五类信号。
数学与专业领域由硕博团队标注并复核,难度对齐 GPQA / FrontierMath 区间。
专门建设中文权威信源调研数据,补齐中文 DeepResearch 训练与评测短板。
调研类 2,000–10,000 题;报告标注 3,000–8,000 篇;数学题 5,000–20,000 题,支持定制扩容。
官网、监管文件、研报、学术库、行业数据库等多类中文权威信源,标注权威度与时效等级。
问题级、证据级、句子级三层标注;数学题提供多路径解答与严格性评审。
数学类难度对齐 GPQA / FrontierMath 区间;调研类按推理跳数与信源稀缺度分级。
为调研型 Agent 提供从检索到成文的全链路监督信号。
以 reasoning trace 作为蒸馏源,提升小模型的长链推理能力。
支撑数学推理模型在竞赛与研究生级题目上的能力上限突破。
基于证据链与引用标注研究模型幻觉来源与可解释性。
JSON/JSONL 结构化数据 + 报告原文(Markdown/PDF)+ 数学题 LaTeX + 标注明细表。
task_id、question、reference_answer、evidence_chain、citations、retrieval_path、reasoning_trace、difficulty。
双审 + 事实性核验 + 专家复核;数学类附证明严格性评分,报告类要素完整率 ≥ 98%。
标准品类 4–6 周;数学与专业报告类 6–8 周;支持分批交付。
商业使用授权 + 信源合规说明 + 个人信息脱敏处理。
{
"task_id": "report-01135",
"question": "2026 年国内医疗影像 AI 三类证获批情况",
"reference_answer": "截至 2026Q2,共 N 张三类证…",
"evidence_chain": [
{"claim": "2026Q2 新增 7 张", "source": "NMPA 公告", "quote": "…"},
{"claim": "胸腔 CT 占比最高", "source": "行业研报", "quote": "…"}
],
"retrieval_path": ["NMPA 数据库 → 分类筛选 → 导出", "研报库 → 关键词检索"],
"reasoning_trace": ["确认口径", "交叉验证", "汇总成表"]
}{
"task_id": "math-04211",
"level": "PhD",
"field": "代数几何",
"statement": "设 X 为光滑射影曲面,证明…",
"solutions": [
{"path": "层论路线", "steps": 12, "rigor": 5},
{"path": "上同调路线", "steps": 9, "rigor": 4}
],
"review": {"correctness": true, "gap_found": "步骤 7 需补充紧性论证"}
}长沙朗慧信息科技有限公司 DataAssetsAPI 平台,支持按领域、难度带、信源类型与标注粒度灵活组合,提供样例预览与专家团队对接。
立即咨询