新增 OCR:从扫描版 PDF 和照片中提取文字
Nova PDF Converter 新增了 OCR(图片转文字) 功能。把扫描版 PDF 或文件照片,变成可以选中、可以搜索的文字。

功能
- 同时支持扫描版 PDF 与图片:PDF 会先逐页渲染成图片再识别,也可以直接拖入 PNG、JPEG 照片
- 11 种语言:日语、英语、中文(简体/繁体)、韩语、西班牙语、法语、德语、葡萄牙语、意大利语、俄语
- 结果可复制或保存:一键复制识别出的文字,或下载为文本文件
- 多页 PDF:一次处理前 50 页,并按页显示进度
原有的「提取文字」工具读取的是 PDF 内部的文字层。扫描版 PDF 本质上是图片,用它什么都取不到——遇到这种情况,现在会引导你使用 OCR。
使用方法
- 打开 OCR 工具
- 拖入 PDF 或图片
- 选择识别语言,点击「识别文字」
- 复制结果,或保存为文本文件
无需注册,也无需安装。仅首次使用时会下载识别数据,之后会被缓存。
关于数据
识别全部在浏览器内完成。PDF、图片以及识别出的文字都不会被发送到服务器。 速度取决于你的设备性能,但作为交换,数据始终留在本地。
所有功能均可免费使用。
适用场景
- 只有扫描件时,想从中引用一段文字
- 想把讲义或白板的照片变成可搜索的文字
- 想让以图片形式保存的旧资料重新变得可以检索
Novare Orbis 还提供其他在浏览器内完成的免费工具,点此查看工具一览。