← 返回文章列表

新增 OCR:从扫描版 PDF 和照片中提取文字

nova-pdf-converter发布

Nova PDF Converter 新增了 OCR(图片转文字) 功能。把扫描版 PDF 或文件照片,变成可以选中、可以搜索的文字。

从扫描件中提取文字

功能

  • 同时支持扫描版 PDF 与图片:PDF 会先逐页渲染成图片再识别,也可以直接拖入 PNG、JPEG 照片
  • 11 种语言:日语、英语、中文(简体/繁体)、韩语、西班牙语、法语、德语、葡萄牙语、意大利语、俄语
  • 结果可复制或保存:一键复制识别出的文字,或下载为文本文件
  • 多页 PDF:一次处理前 50 页,并按页显示进度

原有的「提取文字」工具读取的是 PDF 内部的文字层。扫描版 PDF 本质上是图片,用它什么都取不到——遇到这种情况,现在会引导你使用 OCR。

使用方法

  1. 打开 OCR 工具
  2. 拖入 PDF 或图片
  3. 选择识别语言,点击「识别文字」
  4. 复制结果,或保存为文本文件

无需注册,也无需安装。仅首次使用时会下载识别数据,之后会被缓存。

关于数据

识别全部在浏览器内完成。PDF、图片以及识别出的文字都不会被发送到服务器。 速度取决于你的设备性能,但作为交换,数据始终留在本地。

所有功能均可免费使用。

适用场景

  • 只有扫描件时,想从中引用一段文字
  • 想把讲义或白板的照片变成可搜索的文字
  • 想让以图片形式保存的旧资料重新变得可以检索

👉 试用 OCR 工具

Novare Orbis 还提供其他在浏览器内完成的免费工具,点此查看工具一览