研究团队需要为AI辅助的文献综述工作制定明确的规则。没有政策,AI的使用可能变得不一致:一个人用它来搜索,另一个人用它来提取,还有人用它来引用,而没有人记录检查了什么。
AI文献综述政策不需要很长。它需要定义允许的用途、限制的用途、来源验证、人类责任和文档记录。
本文提供了一个实用的政策结构,团队可以将其用于文献综述、范围综述、论文项目、实验室综述和证据映射工作。
什么是AI文献综述政策?
AI文献综述政策是一套简短的规则,解释了团队在文献搜索、筛选、阅读、提取、综合和引用检查过程中如何使用AI工具。
它应该回答:
- 可以使用哪些AI工具?
- 它们可以支持哪些任务?
- 哪些任务需要人工审查?
- 如何验证来源?
- 如何记录AI的使用?
- 哪些材料不应上传?
- 谁拥有最终研究决策权?
该政策为团队提供了一种共享的方法。它还使AI的使用更容易向导师、合作者、机构和期刊解释。
为什么研究团队需要政策?
团队需要政策,因为AI错误往往是工作流错误,而不仅仅是工具错误。同一个工具可以根据周围的规则集被谨慎或粗心地使用。
政策有助于防止:
- 来自AI摘要的无依据声明。
- 未经验证的引用。
- 不一致的筛选决策。
- 隐藏的数据提取错误。
- 最终决策责任不明确。
- 上传敏感或未发表的材料。
- 方法部分无法解释工具使用。
目标不是减慢团队速度。目标是防止工作后来变得难以信任。
有关更广泛的清单,请参阅研究团队的负责任AI自动化清单。
政策应该对允许的AI用途说些什么?
政策应指明AI可以协助但不做最终决策的任务。这些通常是发现、组织和阅读支持任务。
允许的用途可能包括:
- 头脑风暴搜索词。
- 查找候选论文。
- 为分诊总结摘要。
- 为人工审查建议主题。
- 为深入阅读起草问题。
- 定位可能的方法、发现或局限性部分。
- 在高层次上比较保存的论文。
- 帮助格式化搜索日志或提取表。
每个允许的用途都应包括检查。例如:“AI可以总结摘要以进行分诊,但审稿人必须在记录决定之前检查原始摘要。”
政策应该限制或禁止什么?
政策应限制任何可能悄然改变综述证据基础、结论或学术诚信的AI使用。
限制的用途可能包括:
- 在没有人工审查的情况下做出最终的纳入或排除决定。
- 未经验证创建引用。
- 使用AI摘要作为证据而不检查论文。
- 在没有来源位置检查的情况下提取高风险字段。
- 未经批准上传机密或未发表的材料。
- 生成未经来源检查的最终综合声明。
- 未经团队批准更改综述问题或标准。
政策不需要完全禁止AI接触这些任务。它可以在要求明确的人工验证的同时允许协助。
有关引用问题,请参阅如何检查论文是否已被更正或撤回。
政策应如何定义人工审查?
人工审查应与工作流中的特定点相关联。模糊的承诺“研究人员会检查”比指定的审查步骤更弱。
定义谁检查:
- 搜索字符串。
- 纳入和排除标准。
- 筛选决策。
- 数据提取字段。
- 引用列表。
- 摘要声明。
- 综合段落。
- 最终参考文献。
还要定义如何记录检查。对于许多团队来说,状态列如未检查、已检查、有争议或已排除可能就足够了。
有关提取检查,请参阅AI文献综述的数据提取质量控制。
政策应该对来源验证说些什么?
政策应声明综述中使用的任何声明都必须可追溯到来源。仅AI输出不是来源。
要求对以下内容进行来源验证:
- 研究设计。
- 样本或数据集。
- 干预、暴露或方法。
- 结果或测量。
- 主要发现。
- 局限性。
- 引用详细信息。
- 相关时的撤回或更正状态。
政策还应尽可能要求来源位置。页码、表格、图形、部分或确切的论文位置使后续审查更加容易。
这是政策中使AI辅助写作保持扎实的部分。
政策应如何涵盖筛选和停止规则?
如果AI影响筛选顺序或筛选决策,政策应定义如何记录该使用。这对于主动学习或AI优先排序的工作流尤其重要。
政策应指定:
- AI是仅对记录进行排序还是也提出决策建议。
- 是否将筛选所有记录。
- 如果不是所有记录都被筛选,适用什么停止规则。
- 是否需要随机审计样本。
- 如何解决冲突。
- 如何存储排除的记录。
- 如何报告记录的最终流程。
有关AI优先排序的筛选,请参阅系统综述中的主动学习筛选是什么和AI辅助综述中何时停止筛选。
政策应该对隐私和上传说些什么?
政策应定义哪些材料可以上传到AI工具,哪些不能。这保护了未发表的工作、敏感数据、机密合作材料和受限文件。
包括以下规则:
- 公开论文。
- 付费墙后的PDF。
- 未发表的手稿。
- 基金申请书。
- 人类受试者材料。
- 内部实验室笔记。
- 专有数据集。
- 第三方机密文件。
如果团队不确定文件是否可以上传,政策应要求在上传前获得批准。
隐私规则不是次要问题。它们决定了哪些工具可以用于哪些材料。
政策应在文档记录中要求什么?
文档记录应足够轻量以便维护,但足够具体以便检查。要求不可能完成的记录保存的政策将被忽略。
记录:
- 工具名称。
- 使用日期。
- 执行的任务。
- 使用的来源集。
- 相关时的提示或任务摘要。
- 输出类型。
- 人工审查状态。
- 最终决定或行动。
- 已知局限性。
对于许多团队来说,这可以是搜索日志、筛选日志、提取表或项目笔记。
有关更详细的记录结构,请参阅AI辅助综述的文献搜索日志模板。
AI文献综述政策可以是什么样子?
以下是一个团队可以采用的简洁政策结构:
目的: AI工具可以支持文献发现、分诊、组织和来源检查。它们不能取代最终研究决策中的人类判断。
允许的用途: 团队成员可以使用经批准的AI工具来生成搜索想法、查找候选论文、为分诊总结记录、将论文组织成主题,并针对已知来源集提出问题。
人工审查: 纳入决定、排除决定、提取的证据、引用使用和综合声明必须由研究人员对照原始来源进行检查。
来源验证: 最终综述中使用的任何声明都必须链接到论文或来源位置。AI生成的摘要不被接受为独立证据。
引用检查: AI建议或格式化的引用必须在使用前进行验证。参考文献应检查存在性、元数据准确性、声明支持以及相关时的更正或撤回状态。
隐私: 机密、未发表、可识别或受限的材料不得上传到AI工具,除非项目所有者批准使用。
文档记录: AI辅助步骤应记录工具名称、任务、日期、来源集、人工审查状态和最终决定。
问责制: 研究团队对最终文献综述负责,包括方法、来源选择、提取的证据、引用和结论。
WisPaper如何支持基于政策的工作流?
WisPaper可以作为研究助手融入基于政策的工作流,用于论文发现、分诊、图书馆组织以及针对已知论文集提问。Deep Search、Scholar Agent和Inspiration Discovery可以帮助研究人员从自然语言问题转向候选论文。
论文卡片显示来源标签、摘要、作者、出版详细信息和预览图像,这有助于研究人员在深入阅读之前做出初步分诊决定。My Library允许用户保存或上传论文,Library QA可以基于用户自己的图书馆回答问题。
对于引用检查,由WisPaper提供支持的TrueCite会根据真实学术数据库检查BibTeX文件,以标记幻觉引用。负责任的政策仍应要求研究人员验证每个来源是否支持所引用的声明。




