研究方法 / 文献综述
AI 文献综述完整方法:从一个问题到可编辑初稿
不要逐篇打开、逐篇总结。先把研究问题拆成可以并行搜索的分支,再让文献、证据表、提纲和正文沿同一套结构推进。
本文目录
文献综述的大量时间花在检索、下载、阅读、归类和引用之间的重复切换。AI Native 方法先定义交付结构,再并行处理资料。
下面的流程既可以手工执行,也可以整体交给云端研究 Agent。页面中的表格和任务文本可以直接复用。

第一步:把题目拆成可以并行搜索的问题
先写出研究对象、核心变量、方法和应用场景。每一项都成为一条独立检索支线,最后再合并。
| 支线 | 要回答的问题 | 检索方向 |
|---|---|---|
| 概念与范围 | 这个主题通常怎样定义? | 定义、分类、边界 |
| 主要方法 | 研究者用什么方法解决? | 模型、实验、数据 |
| 结果与争议 | 结论一致在哪里、分歧在哪里? | 比较、局限、冲突 |
| 发展方向 | 近年的工作转向什么? | 新方法、新数据、新场景 |
第二步:为每条支线构造中英文检索式
不要只搜论文题目中的完整短语。把同义词、缩写、上位概念和方法词分别列出,再组合成多条查询。
(large language model OR LLM OR foundation model)
AND (literature review OR evidence synthesis)
AND (workflow OR automation OR agent)- 每条查询只承担一个支线,不把所有概念塞进同一条长检索式
- 中文主题同时准备英文术语和常用缩写
- 先看高相关结果中的关键词,再扩充第二轮查询
第三步:先建立文献池,再开始精读
文献池的作用是把下载、去重和初筛一次完成。后续阅读只在这个集合中推进,不再频繁回到搜索结果。

第四步:批量阅读时只提取后面会用到的信息
先从所有论文中提取同一组字段,再根据综述结构决定哪些论文需要全文精读。
- 1快速筛选按题目、摘要和结论判断是否进入文献池。
- 2统一提取提取研究问题、方法、数据、主要发现和局限。
- 3按主题归类把论文放入方法、结果、争议或应用场景等主题组。
- 4只精读关键文献对承担定义、关键方法或主要争议的论文读取全文。
第五步:用证据表替代零散的论文摘要
证据表按你要写的段落组织信息。同一行可以放多篇论文,同一篇论文也可以出现在多个主题下。
| 主题 | 论文与来源 | 可用于正文的结论 | 放入哪一节 |
|---|---|---|---|
| 工具调用 | Boiko et al., 2023 | LLM Agent 可以组合网页与文档搜索、代码执行和实验自动化工具 | 工具增强型 Agent |
| 端到端执行 | Lu et al., 2024 | 系统可在同一流程中生成研究想法、编写代码、运行实验、绘图和撰写论文 | 研究流程自动化 |
| 跨领域基础 | Zhang et al., 2024 | Scientific LLM 已覆盖多学科和多模态任务,但训练数据与评价方法差异明显 | 模型与任务基础 |
短综述:研究 Agent 正从单点问答转向连续执行
Scientific LLM 的应用已经超出文本生成。Zhang 等对 260 多个科学大语言模型的综述表明,这类模型覆盖文本、分子和蛋白质等不同模态,并被用于多种科学发现任务[1]。这为研究 Agent 提供了领域模型和任务接口,但不同学科仍需要各自的数据与评价方法。
研究 Agent 的关键变化是把模型接入外部工具。Coscientist 组合网页搜索、文档检索、代码执行和实验自动化,在化学任务中完成规划、控制和优化[2]。The AI Scientist 则把想法生成、代码编写、实验运行、结果绘图和论文写作连成一个连续流程[3]。这些工作共同说明,跨步骤复用资料和运行结果是主要的效率来源;单次生成更长文本无法替代连续执行。
引用文献
- [1] Zhang et al. A Comprehensive Survey of Scientific Large Language Models and Their Applications in Scientific Discovery. EMNLP 2024.
- [2] Boiko et al. Autonomous chemical research with large language models. Nature 624, 570–578 (2023).
- [3] Lu et al. The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery. arXiv:2408.06292 (2024).
第六步:先用证据表生成提纲,再写带引用初稿
每个二级标题只回答一个问题,并在标题下列出要使用的证据和引用。这样写作阶段不需要重新翻找文献。
- 1.概念范围与研究对象
- 2.现有方法的主要分类
- 3.各类方法使用的数据与实验设置
- 4.研究结论的共同点与差异
- 5.近期工作的新方向
- 6.仍待解决的问题
普通聊天、文献工具和云端 Agent 的区别
| 工作方式 | 适合做什么 | 需要手工接力的部分 |
|---|---|---|
| 普通聊天 | 讨论选题、改写局部文字 | 搜索、下载、文件整理和引用回填 |
| 文献检索工具 | 搜索、摘要和单篇问答 | 批量下载、跨文献表格和完整交付 |
| 云端研究 Agent | 从检索支线持续执行到文献池、证据表和初稿 | 用户只需补充范围、材料和交付要求 |
最终交付应当保留中间材料
综述正文之外,保留文献清单、证据表和引用文件,后续扩写或改题时可以直接复用。
常见问题
文献综述要先确定多少篇文献?
先按检索支线建立候选池,再根据篇幅和主题覆盖筛选核心文献。不要在开始检索前固定一个没有依据的数量。
可以上传自己的 PDF 吗?
可以。在 Scientify 工作区上传 PDF、Word、BibTeX 或已有文献表,Agent 会把它们与新检索的资料放入同一文献池。
能输出带引用的 Word 或 LaTeX 吗?
可以在任务中明确要求文内引用格式、Word、PDF、LaTeX 和参考文献文件。
写完后还能继续增加一个主题吗?
可以。在同一工作区增加新的检索支线,更新证据表,再只重写受影响的章节。