2026-09-16 · 约 6 分钟读完

PDF 打开乱码怎么解决?先分清这 4 种情况

PDF 乱码不都是文件坏了。本文按字体缺失、编码错误、文件损坏、扫描件四种情况分别给出判断方法和处理顺序。

情况一:换了台电脑才乱码

同一份 PDF 在别人电脑上正常、在你的电脑上乱码,多半是字体问题。PDF 可以只嵌入字体子集甚至完全不嵌入字体,依赖阅读器本地的字体来渲染。本地缺字体时,阅读器只能用替代字体,字就变形了。

判断方法:把文件发给别人看看是否正常。如果别人正常,就换个阅读器试试,或者让发送方重新导出并勾选「嵌入所有字体」。

情况二:所有字都是方块或问号

这通常是字符编码问题,常见于老版本工具导出的文件,或者经过多次格式转换的文件。文件里的字符编码指向了一个不存在的字形,阅读器只能画方块。

这类文件几乎无法直接修复,可行的办法是把页面转成图片,然后走 OCR 重新识别出文字。虽然要绕一圈,但结果通常比继续折腾原文件更快。

情况三:只有部分是乱码

如果正文正常、只有数学公式、特殊符号或生僻字乱码,说明问题只出在部分字符的字体子集上。这种情况对阅读影响不大,提取文字时把乱码部分手动修正即可。

还有一种表现是复制出来乱码但屏幕显示正常——这是编码映射错误,说明文档的字符到字形的映射被破坏了。需要提取内容的话,直接 OCR 比修映射划算。

情况四:打开就报错或空白

这种情况文件可能真的损坏了。先确认下载完整:传输中断导致的文件不完整,表现和损坏很像。比对一下文件大小是否和发送方一致。

如果确认是损坏,可以试试用不同的阅读器打开——不同工具对损坏文件的容错能力差别很大,有的能跳过损坏部分把剩余页面显示出来。打开后立刻另存一份,能救回多少算多少。

一个通用的排查顺序

遇到乱码别急着找修复工具,按这个顺序走:换阅读器 → 换电脑验证是否本地问题 → 比对文件大小确认是否下载完整 → 转图片看内容是否完好 → 用 OCR 重新取文字。前四步都是几分钟的事,能快速定位到真正的原因。

  • 换一个阅读器打开
  • 发给别人验证是不是本地字体问题
  • 比对文件大小,确认下载完整
  • 转成图片,看内容本身是否完好
  • 内容完好就 OCR 重新取文字

常见问题

继续阅读