PDF 文献整理器
痛点
电脑里散落着大量从各种渠道下载的 PDF 论文,有的在下载文件夹,有的在桌面,文件名还是乱码——手动逐个导入 Zotero 并整理元数据要花几个小时。
AI4Paper 的 PDF 整理器可以批量扫描文件夹,自动识别 PDF 元数据,导入 Zotero 并规范化命名。
工作原理
- 扫描文件夹:递归扫描指定目录(含 3 级子目录)中的所有 PDF 文件
- 提取元数据:从 PDF 内容中提取 DOI、标题、作者等信息
- 在线匹配:通过 DOI/标题在 CrossRef、Semantic Scholar 等数据库中匹配完整元数据
- 导入 Zotero:创建条目并自动关联 PDF 附件
- 规范命名:按配置的命名模板重命名 PDF 文件
使用方法
配置
- 编辑 → 设置 → AI4Paper → 功能
- 设置 PDF 整理器 的命名模板
命名模板
支持以下占位符:
| 占位符 | 含义 | 示例 |
|---|---|---|
%a | 第一作者姓 | Wang |
%y | 发表年份 | 2024 |
%t | 标题(截断) | Deep Learning for... |
%j | 期刊名 | Nature |
{...} | 条件组(有值才显示) |
默认模板:%a_%y_%t → Wang_2024_Deep Learning for Medical Imaging.pdf
执行整理
- 右键 → AI4Paper → 🔧 基础工具 → PDF 文献整理
- 选择要扫描的文件夹
- 插件开始扫描和处理
- 完成后显示导入结果统计
注意事项
- 建议先在小文件夹上测试,确认效果后再处理大量文件
- 已在 Zotero 中存在的 PDF 不会重复导入
- 无法识别的 PDF(扫描件、图片版)可能需要手动处理
常见问题
Q: 支持中文论文吗?
支持。中文 PDF 会通过标题匹配 CNKI 等数据库获取元数据。
Q: 原始 PDF 文件会被移动吗?
默认是复制到 Zotero 的存储目录。原始文件不受影响。

