Skip to content

PDF 文献整理器

痛点

电脑里散落着大量从各种渠道下载的 PDF 论文,有的在下载文件夹,有的在桌面,文件名还是乱码——手动逐个导入 Zotero 并整理元数据要花几个小时。

AI4Paper 的 PDF 整理器可以批量扫描文件夹,自动识别 PDF 元数据,导入 Zotero 并规范化命名

工作原理

  1. 扫描文件夹:递归扫描指定目录(含 3 级子目录)中的所有 PDF 文件
  2. 提取元数据:从 PDF 内容中提取 DOI、标题、作者等信息
  3. 在线匹配:通过 DOI/标题在 CrossRef、Semantic Scholar 等数据库中匹配完整元数据
  4. 导入 Zotero:创建条目并自动关联 PDF 附件
  5. 规范命名:按配置的命名模板重命名 PDF 文件

使用方法

配置

  1. 编辑设置AI4Paper功能
  2. 设置 PDF 整理器 的命名模板

命名模板

支持以下占位符:

占位符含义示例
%a第一作者姓Wang
%y发表年份2024
%t标题(截断)Deep Learning for...
%j期刊名Nature
{...}条件组(有值才显示)

默认模板:%a_%y_%tWang_2024_Deep Learning for Medical Imaging.pdf

执行整理

  1. 右键 → AI4Paper🔧 基础工具PDF 文献整理
  2. 选择要扫描的文件夹
  3. 插件开始扫描和处理
  4. 完成后显示导入结果统计

注意事项

  • 建议先在小文件夹上测试,确认效果后再处理大量文件
  • 已在 Zotero 中存在的 PDF 不会重复导入
  • 无法识别的 PDF(扫描件、图片版)可能需要手动处理

常见问题

Q: 支持中文论文吗?

支持。中文 PDF 会通过标题匹配 CNKI 等数据库获取元数据。

Q: 原始 PDF 文件会被移动吗?

默认是复制到 Zotero 的存储目录。原始文件不受影响。

让天下没有难读的 Paper,让天下没有难做的科研