AI Metadata Remover

本地 PDF 文档属性清理器

PDF Metadata Remover

先检查 PDF,再从新生成的副本中移除文档 Info 字典和目录级 XMP,下载前对输出文件重新扫描。

等待 PDF免费 · 无需登录

检查、移除并验证 PDF 元数据

先选择一个 PDF 查看支持识别的元数据。清理时会重写一份新文件,移除文档属性和目录级 XMP,再检查输出结果。

把一个 PDF 拖到这里

或从设备中选择 PDF

仅支持 PDF单个文件,上限 25 MB

设备端 WebAssembly
不上传文件
重写副本后复检

4 个来源可追溯 PDF 样本 · 18 项跨浏览器页面检查

查看测试证据

PDF 批量工作区

批量移除并验证支持的 PDF 属性

从多份 PDF 中移除 Info 字典和目录级 XMP,重新扫描每个输出,并下载本地压缩包。

添加批量文档

最多 5 份 PDF · 每份 25 MB · 文件留在此设备

PDF Metadata Remover 修改什么

结构重写完成后,再扫描一次

清理器会移除两处受支持的元数据引用,并让 qpdf 写出一份新 PDF。之后用同一套规则复检;只要元数据仍存在或页数发生变化,就不会声称清理成功。

文档属性

读取 PDF Info 字典中的标题、作者、主题、关键词、创建应用、生成器、日期及其他支持识别的条目。

目录级 XMP

读取 catalog Metadata 数据流中支持识别的 Dublin Core、Adobe PDF、XMP、版权与地点字段。

验证后的输出

输出文件会重新检查两处受支持的元数据位置,同时明确报告页数是否一致,以及数字签名受到的影响。

PDF 里的元数据是从哪来的

大多数 PDF 文档属性不是你亲手填写的,而是软件在保存时自动写入的。导出工具、驱动程序和编辑器会顺手填充 Info 字典和目录级 XMP。弄清每个字段是谁写进去的,才更容易判断重写后的副本应该留下什么。

办公软件导出时替你写下账号名

Word、Google Docs 或 Pages 导出 PDF 时,通常会把账号显示名复制进 Author 字段,把自己的软件名和版本写进 Creator 与 Producer,再盖上创建和修改时间戳。这些内容不会出现在页面上,所以多数人从未打开过文档属性就把文件发了出去。如果账号名和你署名用的名字不一致,这个偏差会跟着每一次导出传播,直到一次结构重写把它移除。

扫描仪、驱动和排版工具留下软件指纹

PDF 不一定出自办公套件,同样会携带元数据。扫描仪固件、打印为 PDF 的驱动、LaTeX 发行版和虚拟 PDF 打印机都会在 Producer 或 Creator 里报出自己的名字,往往精确到版本号。这类指纹能透露文件出自哪套硬件或工具链,比许多发送者愿意告诉陌生人的信息要多。

多次编辑与合并让旧痕迹越积越多

一份经过多次编辑、合并或转换的文档,可能带着不同阶段写入的字段:一个工具设置了 Author,后来的工具更新了 Producer,合并操作还可能保留更早修订版的 XMP。最后一次导出并不一定会清除更早软件写下的内容,所以你最后看到的属性未必是文件里仅有的属性。

什么场景值得先删掉 PDF 里的作者

文档属性在自己团队内部通常无关紧要,可一旦 PDF 跨出组织边界,含义就变了。以下是人们最常需要在发出副本前移除 PDF 作者或清空文档属性的几种场景。

简历与求职申请

简历的 Author 字段里装的往往不是页面顶端印着的名字,而是某个账号显示名:旧昵称、家人电脑的登录名,甚至是帮忙润色的人。招聘方只要打开文档属性就能看到这种不一致。用一份移除了 Info 字典和目录级 XMP 的重写副本投递,能让申请材料只呈现你真正写在页面上的内容。

投标、报价与客户提案

在投标书或提案里,Producer 和日期字段可能向细心的读者透露超出你计划的信息:几年前导出后反复套用的模板、截止日前凌晨两点才拼好的报价,或者注册在另一家公司名下的软件。发出前从副本中移除文档属性,能让谈判聚焦在报价本身,而不是文件的生产过程。

匿名评审与盲审投稿

双盲评审的前提是稿件不暴露作者身份,可 Author 字段恰恰经常在导出时被文字处理器或 LaTeX 工具链自动填上作者信息。评审人和编辑一次点击就能打开文档属性。提交一份移除了 Info 字典与 XMP 的重写副本,等于关掉一条本可避免、却足以破坏匿名要求的通道。

对外发布的报告、白皮书与新闻稿

以组织名义发布的文件,应该只讲组织想讲的内容,而不是某位员工的登录名或草稿的修订时间线。许多传播团队已经把清理文档属性列为发布检查清单上的一项,与校对和链接检查并列。经过验证的结构重写让这一步有据可查:新副本会被复检,只有确认支持范围内的字段已清空才提供下载。

明确能力边界

移除 PDF 元数据,不等于 PDF 安全加固

这个工具只承诺一个狭窄、可测试的范围:标准文档属性和目录级 XMP。安全加固需要另一套规则、预览与验证证据。

本工具包含

  • 检查 PDF trailer 中的 Info 字典。
  • 检查 catalog 目录级 XMP 元数据流。
  • 移除两处引用,重写并复检一份新副本。
  • 文件流程在浏览器 Worker 中本地运行。

本工具不包含

  • 不声称完成 PDF 净化或安全加固。
  • 不移除脚本、动作、附件、表单或批注。
  • 不搜索隐藏文本、涂黑内容、图层或嵌入文件内部的元数据。
  • 不处理加密或受密码保护的 PDF。

看得见的本地流程

先检查,再重写并验证

在你看到检测结果并接受数字签名后果之前,工具不会开始清理。

  1. 01

    检查

    修改前先读取支持识别的文档属性、XMP、页数和签名标记。

  2. 02

    重写

    移除受支持的元数据引用,使用 qpdf WebAssembly 创建一份新 PDF。

  3. 03

    复检

    再次检查新 PDF;确认元数据不存在且页数一致后,才允许下载。

自己动手验证清理结果

不要只听清理工具的一面之词,包括这一个。重写生成的副本是一个可以独立检查的新文件,下面三种方式都能确认这次重写到底移除了什么。

在 PDF 阅读器里打开属性面板

用 Acrobat Reader 或浏览器自带的查看器打开下载的副本,查看文档属性对话框。Title、Author、Subject、Keywords 以及软件相关条目现在应当是空的。这个检查用的是你现成的普通软件,是确认重写结果与报告一致的第一道快速验证。

exiftool file.pdf

用命令行 ExifTool 交叉核对

想要独立的第二意见,可以对清理后的副本运行 exiftool file.pdf。ExifTool 用一套完全独立的实现读取同样的 Info 字典和 XMP 位置,它的输出与本工具的复检结果相互印证,比工具给自己打分更有说服力。它仍会列出页数、PDF 版本等结构条目,这些不属于个人元数据。

了解内置复检覆盖什么

决定下载按钮是否可用的复检,只检查两处位置:trailer Info 字典和目录级 XMP 数据流,外加页数是否保持一致。范围刻意收窄,是为了让每一次通过都有明确含义。它不会检查批注、附件或嵌入文件,请把它当作范围内的确认,而不是一次全面审计。

PDF 元数据问题

检查或移除之前,先说清楚

关键是知道工具能够证明什么、重写会改变什么,以及哪些风险仍需要独立的安全流程。

这个清理器会删除哪些 PDF 元数据?
它会从新重写的 PDF 中移除 trailer Info 引用和 catalog Metadata 引用,再检查这两处位置。它不声称删除附件、页面内容、批注或其他嵌入对象内部的元数据。
PDF 会离开我的设备吗?
不会。读取、重写和复检都在本地浏览器 Worker 中运行。工具不会把文件名、PDF 字节、元数据值或文件哈希发送给处理 API。
带数字签名的 PDF 会怎样?
任何重写都会让现有数字签名失效。清理器会保守检测常见签名结构、解释后果并要求明确同意,但不会验证签名者或证书。
能处理受密码保护的 PDF 吗?
不能。加密和受密码保护的 PDF 会安全停止处理并保持不变;输入密码和解密不在当前本地工具范围内。
移除元数据后,PDF 就安全吗?
不能这样判断。元数据移除不等于 PDF 净化。脚本、动作、表单、附件、批注、隐藏页面内容、涂黑内容和嵌入文件需要单独的安全加固流程。
当前文件限制是什么?
一次处理一个 PDF,单个文件不超过 25 MB。结构异常、需要修复或已加密的 PDF 会被拒绝,不生成输出。
能删掉 PDF 里的作者名吗?
能,但范围是明确的。生成重写副本时,Info 字典中的 Author 条目和目录级 XMP 中的创作者字段会被移除,复检确认它们已消失后才能下载。工具不会改动可见内容:写在正文里的名字、页眉页脚、批注,或嵌入图片内部的元数据,都属于页面内容或其他对象,不属于文档属性,会原样保留。
为什么清理后文件大小变了?
因为清理副本来自一次结构重写,不是原地抹掉几个字节。qpdf 写出新文件时会重新组织对象树并使用自己的压缩方式,所以输出可能比原件小,偶尔也可能更大。大小变化是重写的正常副产物,不是元数据残留的信号。判断是否清理干净,请以复检结果为准。
扫描件或 OCR 后的 PDF 能清理吗?
可以,只要文件结构有效且未加密。扫描件本质上仍是页面内容为图像的 PDF,OCR 文字层也不改变这一点。重写移除的仍然只是两处内容:文档属性和目录级 XMP。扫描页面的图像和已识别的文字层会原样进入新副本,不做任何修改。

只想查看,不想重写?

打开 PDF Metadata Viewer,只读查看文档属性和目录级 XMP。

打开 PDF Metadata Viewer