文档属性
读取 PDF Info 字典中的标题、作者、主题、关键词、创建应用、生成器、日期及其他支持识别的条目。
本地 PDF 文档属性清理器
先检查 PDF,再从新生成的副本中移除文档 Info 字典和目录级 XMP,下载前对输出文件重新扫描。
先选择一个 PDF 查看支持识别的元数据。清理时会重写一份新文件,移除文档属性和目录级 XMP,再检查输出结果。
把一个 PDF 拖到这里
或从设备中选择 PDF
仅支持 PDF单个文件,上限 25 MB
4 个来源可追溯 PDF 样本 · 18 项跨浏览器页面检查
查看测试证据PDF 批量工作区
从多份 PDF 中移除 Info 字典和目录级 XMP,重新扫描每个输出,并下载本地压缩包。
添加批量文档
最多 5 份 PDF · 每份 25 MB · 文件留在此设备
PDF Metadata Remover 修改什么
清理器会移除两处受支持的元数据引用,并让 qpdf 写出一份新 PDF。之后用同一套规则复检;只要元数据仍存在或页数发生变化,就不会声称清理成功。
读取 PDF Info 字典中的标题、作者、主题、关键词、创建应用、生成器、日期及其他支持识别的条目。
读取 catalog Metadata 数据流中支持识别的 Dublin Core、Adobe PDF、XMP、版权与地点字段。
输出文件会重新检查两处受支持的元数据位置,同时明确报告页数是否一致,以及数字签名受到的影响。
大多数 PDF 文档属性不是你亲手填写的,而是软件在保存时自动写入的。导出工具、驱动程序和编辑器会顺手填充 Info 字典和目录级 XMP。弄清每个字段是谁写进去的,才更容易判断重写后的副本应该留下什么。
Word、Google Docs 或 Pages 导出 PDF 时,通常会把账号显示名复制进 Author 字段,把自己的软件名和版本写进 Creator 与 Producer,再盖上创建和修改时间戳。这些内容不会出现在页面上,所以多数人从未打开过文档属性就把文件发了出去。如果账号名和你署名用的名字不一致,这个偏差会跟着每一次导出传播,直到一次结构重写把它移除。
PDF 不一定出自办公套件,同样会携带元数据。扫描仪固件、打印为 PDF 的驱动、LaTeX 发行版和虚拟 PDF 打印机都会在 Producer 或 Creator 里报出自己的名字,往往精确到版本号。这类指纹能透露文件出自哪套硬件或工具链,比许多发送者愿意告诉陌生人的信息要多。
一份经过多次编辑、合并或转换的文档,可能带着不同阶段写入的字段:一个工具设置了 Author,后来的工具更新了 Producer,合并操作还可能保留更早修订版的 XMP。最后一次导出并不一定会清除更早软件写下的内容,所以你最后看到的属性未必是文件里仅有的属性。
文档属性在自己团队内部通常无关紧要,可一旦 PDF 跨出组织边界,含义就变了。以下是人们最常需要在发出副本前移除 PDF 作者或清空文档属性的几种场景。
简历的 Author 字段里装的往往不是页面顶端印着的名字,而是某个账号显示名:旧昵称、家人电脑的登录名,甚至是帮忙润色的人。招聘方只要打开文档属性就能看到这种不一致。用一份移除了 Info 字典和目录级 XMP 的重写副本投递,能让申请材料只呈现你真正写在页面上的内容。
在投标书或提案里,Producer 和日期字段可能向细心的读者透露超出你计划的信息:几年前导出后反复套用的模板、截止日前凌晨两点才拼好的报价,或者注册在另一家公司名下的软件。发出前从副本中移除文档属性,能让谈判聚焦在报价本身,而不是文件的生产过程。
双盲评审的前提是稿件不暴露作者身份,可 Author 字段恰恰经常在导出时被文字处理器或 LaTeX 工具链自动填上作者信息。评审人和编辑一次点击就能打开文档属性。提交一份移除了 Info 字典与 XMP 的重写副本,等于关掉一条本可避免、却足以破坏匿名要求的通道。
以组织名义发布的文件,应该只讲组织想讲的内容,而不是某位员工的登录名或草稿的修订时间线。许多传播团队已经把清理文档属性列为发布检查清单上的一项,与校对和链接检查并列。经过验证的结构重写让这一步有据可查:新副本会被复检,只有确认支持范围内的字段已清空才提供下载。
明确能力边界
这个工具只承诺一个狭窄、可测试的范围:标准文档属性和目录级 XMP。安全加固需要另一套规则、预览与验证证据。
看得见的本地流程
在你看到检测结果并接受数字签名后果之前,工具不会开始清理。
修改前先读取支持识别的文档属性、XMP、页数和签名标记。
移除受支持的元数据引用,使用 qpdf WebAssembly 创建一份新 PDF。
再次检查新 PDF;确认元数据不存在且页数一致后,才允许下载。
不要只听清理工具的一面之词,包括这一个。重写生成的副本是一个可以独立检查的新文件,下面三种方式都能确认这次重写到底移除了什么。
用 Acrobat Reader 或浏览器自带的查看器打开下载的副本,查看文档属性对话框。Title、Author、Subject、Keywords 以及软件相关条目现在应当是空的。这个检查用的是你现成的普通软件,是确认重写结果与报告一致的第一道快速验证。
exiftool file.pdf想要独立的第二意见,可以对清理后的副本运行 exiftool file.pdf。ExifTool 用一套完全独立的实现读取同样的 Info 字典和 XMP 位置,它的输出与本工具的复检结果相互印证,比工具给自己打分更有说服力。它仍会列出页数、PDF 版本等结构条目,这些不属于个人元数据。
决定下载按钮是否可用的复检,只检查两处位置:trailer Info 字典和目录级 XMP 数据流,外加页数是否保持一致。范围刻意收窄,是为了让每一次通过都有明确含义。它不会检查批注、附件或嵌入文件,请把它当作范围内的确认,而不是一次全面审计。
PDF 元数据问题
关键是知道工具能够证明什么、重写会改变什么,以及哪些风险仍需要独立的安全流程。
打开 PDF Metadata Viewer,只读查看文档属性和目录级 XMP。