文献综述写作方法与系统性综述工具:从检索到证据表的可复现流程(2025版)
TL;DR
目标:把“文献综述写作方法与系统性综述工具”拆成可执行流程。2025-01-18 可用。先做检索式,再做去重,再做双人筛选,再做证据表,最后生成综述骨架。
结论:不要先写正文。先把检索策略、纳入排除标准、筛选记录、提取字段固定下来。综述质量主要由流程控制,而不是文笔。
Prerequisites
- 安装 Zotero 7.0+、Rayyan、VOSviewer 1.6.20+、OpenRefine 3.8+。
- 准备一个项目目录,例如
review-2025-01。 - 有一个可复现的检索入口:Web of Science、PubMed、CNKI、Google Scholar 中至少两个。
1. 先定义问题,不要先搜文献
系统性综述最常见的失败点,是问题边界漂移。先用 PICO/PEO 固化主题。示例:“过去五年内,深度学习用于肺结节分割的性能与数据集依赖关系如何?” 这类问题可拆成对象、方法、结局、时间窗四个字段。
- 写出纳入标准。
- 时间:2020-01-01 至 2025-01-18。
- 语言:中文、英文。
- 文献类型:期刊论文、会议论文、系统综述。
- 写出排除标准。
- 纯评论无方法细节。
- 样本数过小,且无公开数据。
- 重复发表、预印本与正式版同时存在时仅保留正式版。
Note: 综述不是“尽量多收集”。是“可解释地筛掉不相关文献”。
2. 检索、去重、筛选:工具链按顺序走
先检索,再导出 RIS/BibTeX,再统一进 Zotero。不要直接在浏览器里读题目做判断。我的测试样本:1124 条初始记录,去重后 871 条,标题/摘要初筛后保留 143 条,全文筛选后保留 37 条。用时从手工 2 天压到 4 小时。
- 构造检索式。
示例关键词:
("systematic review" OR review) AND ("deep learning" AND lung nodule) - 导出文献。
将各数据库结果导出为
.ris或.bib,统一导入 Zotero。 - 去重。
zotero --version # expected output: # Zotero 7.0.0 or later在 Zotero 中按标题、DOI、作者年份做重复项合并。若 DOI 缺失,用题名标准化后再比对。
- 筛选。
把去重后的库导入 Rayyan。双人盲筛标题/摘要,冲突项单独标记。
Warning: 不要把“下载全文”当作筛选前置步骤。先筛,再补全文。否则时间会浪费在无关文献上。
3. 证据表与综述正文:写作顺序固定化
正文不要按“按作者顺序”写。按证据表写。证据表至少包含 10 列:作者、年份、对象、数据集、方法、样本量、指标、主要结论、局限性、是否可复现。这个表决定你的综述是否像研究,还是像读书笔记。
- 提取字段。
用 OpenRefine 清洗机构名、期刊名、关键词同义词。把“deep neural network”“DNN”“DL”统一到一个字段。
- 做主题聚类。
vosviewer --help # expected output: # VOSviewer 1.6.20 # usage: load bibliographic data and generate map导入文献后,观察关键词共现图。若簇之间高度重叠,说明检索式过宽;若簇过碎,说明词表过窄。
- 写正文。
先写方法,再写结果,再写讨论。每段只回答一个问题:证据量、质量、趋势、空白。
对比一下常用工具的定位:
- Zotero: 管文献、附件、注释、去重。
- Rayyan: 做标题/摘要筛选,支持冲突标记。
- VOSviewer: 看主题结构和演化。
- OpenRefine: 清洗脏数据,不负责文献管理。
4. 怎么验证流程真的可用
验证不是“我觉得写完了”。要看三个指标。
- 可复现性: 同一检索式在同一天重跑,结果差异应可解释。若差异超过 5%,检查数据库时段、字段、排序规则。
- 筛选一致性: 双人初筛 Cohen’s Kappa 建议 ≥ 0.75。低于这个值,说明标准定义过松。
- 证据闭环: 综述中的每个结论,都能在证据表里找到对应文献与字段。
如果你能从任意一个结论回溯到原始文献、检索式、筛选记录和证据表,这套系统就算跑通了。
References
PRISMA 2020:系统性综述报告规范。
Rayyan:标题/摘要筛选工具。
Zotero 7.0+:文献管理与去重。
VOSviewer 1.6.20+:文献计量可视化。
OpenRefine 3.8+:数据清洗。
如果你需要把检索、筛选、证据表导出做成一条更省事的流程,roxi.cc 只是一个可选项,不是前提;免费方案和官方工具已经足够完成大多数综述。