PDF 文字识别
识别扫描版 PDF 中的文字,输出可编辑文本
选择文件
本地读取,不上传服务器
点击选择文件
或拖拽到此处,文件仅在本地处理
处理设置
调好参数再开始
识别较慢属正常,页数多请耐心等待
处理结果
生成后可立即下载
使用说明
📖 工具介绍
给扫描版 PDF 做文字识别的工具。上传后选好语言,逐页识别,出来的文字直接可以复制和编辑。
它和「PDF 转文本」是两回事,适用对象完全不同:转文本读的是 PDF 自带的文字层,对扫描件无效;这个工具是把每一页先渲染成图片,再交给识别引擎去认字,所以专治扫描件、拍照文档、截图转成的 PDF。判断用哪个很简单——原文件里的文字能用鼠标选中,就用转文本;选不中,就用这个。
识别引擎完全在你这台设备上运行,不需要把文件传到任何服务器,这也是它比在线识别慢的原因:所有计算都靠你自己的 CPU。一页通常要几秒到十几秒,页数多请耐心等,进度条会显示当前到第几页和识别百分比,中途可以点停止,已经识别完的页会保留下来。
语言支持简体中文、英文和两者混合。渲染倍率决定识别前把页面放大多少,1.5 倍是大多数情况的平衡点,字特别小或者原图模糊时可以提到 2 倍换取更高准确率,代价是更慢。中文与英文识别模型随插件一起提供,不需要联网下载,装好即可离线使用。
中文模型本身包含拉丁字母与数字的字形,所以选「中英混排」时用中文模型也能认出里面的英文单词和数字,只是专有名词的准确率会比纯英文模型略低。如果文档基本是英文,直接选英文更快也更准。反过来以中文为主的文档选中文模型,不要因为混了几个英文单词就切成英文模型。
✨ 功能特点
- 专治扫描件,先渲染再识别,填补转文本工具的空白
- 识别引擎完全本地运行,文件不上传服务器
- 支持简体中文、英文与中英混合三种语言
- 渲染倍率可调,模糊或小字文档可提倍率换准确率
- 实时显示识别进度,可中途停止且已识别页保留
- 结果可一键复制,也可下载为 txt 文件
🚀 使用方式
- 点上传区域选择一个扫描版 PDF,或把文件拖进来
- 选择识别语言,中英混排的文档选「中英混合」
- 选择渲染倍率,默认 1.5 倍即可
- 点「开始处理」,等待逐页识别完成
- 检查结果后点「复制文本」或「下载结果」保存
⚠️ 注意事项
- 识别速度慢是正常的:计算全靠本地 CPU,一页数秒到十几秒,页数多请耐心等待
- 识别结果需要人工校对:手写体、艺术字、极低分辨率的文档准确率会明显下降
- 语言包已内置本地:中文与英文识别模型随插件一起提供,无需联网下载即可使用
- 排版不会还原:输出的是纯文字流,表格与多栏结构需要自己整理
- 超大文件受内存限制:页数极多时耗时很长,建议分批识别