🔎

PDF 文字识别

识别扫描版 PDF 中的文字,输出可编辑文本
识别 📂 办公 👤 ToolWorld 🏷️ v1.2.2
加载中...
选择文件 本地读取,不上传服务器
点击选择文件 或拖拽到此处,文件仅在本地处理
处理设置 调好参数再开始

识别较慢属正常,页数多请耐心等待

添加文件后点「开始处理」,全程在浏览器本地完成,文件不会上传

处理结果 生成后可立即下载

使用说明

📖 工具介绍


给扫描版 PDF 做文字识别的工具。上传后选好语言,逐页识别,出来的文字直接可以复制和编辑。

它和「PDF 转文本」是两回事,适用对象完全不同:转文本读的是 PDF 自带的文字层,对扫描件无效;这个工具是把每一页先渲染成图片,再交给识别引擎去认字,所以专治扫描件、拍照文档、截图转成的 PDF。判断用哪个很简单——原文件里的文字能用鼠标选中,就用转文本;选不中,就用这个。

识别引擎完全在你这台设备上运行,不需要把文件传到任何服务器,这也是它比在线识别慢的原因:所有计算都靠你自己的 CPU。一页通常要几秒到十几秒,页数多请耐心等,进度条会显示当前到第几页和识别百分比,中途可以点停止,已经识别完的页会保留下来。

语言支持简体中文、英文和两者混合。渲染倍率决定识别前把页面放大多少,1.5 倍是大多数情况的平衡点,字特别小或者原图模糊时可以提到 2 倍换取更高准确率,代价是更慢。中文与英文识别模型随插件一起提供,不需要联网下载,装好即可离线使用。

中文模型本身包含拉丁字母与数字的字形,所以选「中英混排」时用中文模型也能认出里面的英文单词和数字,只是专有名词的准确率会比纯英文模型略低。如果文档基本是英文,直接选英文更快也更准。反过来以中文为主的文档选中文模型,不要因为混了几个英文单词就切成英文模型。

✨ 功能特点


  • 专治扫描件,先渲染再识别,填补转文本工具的空白
  • 识别引擎完全本地运行,文件不上传服务器
  • 支持简体中文、英文与中英混合三种语言
  • 渲染倍率可调,模糊或小字文档可提倍率换准确率
  • 实时显示识别进度,可中途停止且已识别页保留
  • 结果可一键复制,也可下载为 txt 文件

🚀 使用方式


  1. 点上传区域选择一个扫描版 PDF,或把文件拖进来
  2. 选择识别语言,中英混排的文档选「中英混合」
  3. 选择渲染倍率,默认 1.5 倍即可
  4. 点「开始处理」,等待逐页识别完成
  5. 检查结果后点「复制文本」或「下载结果」保存

⚠️ 注意事项


  • 识别速度慢是正常的:计算全靠本地 CPU,一页数秒到十几秒,页数多请耐心等待
  • 识别结果需要人工校对:手写体、艺术字、极低分辨率的文档准确率会明显下降
  • 语言包已内置本地:中文与英文识别模型随插件一起提供,无需联网下载即可使用
  • 排版不会还原:输出的是纯文字流,表格与多栏结构需要自己整理
  • 超大文件受内存限制:页数极多时耗时很长,建议分批识别

相关推荐

⏫︎