OLOCR 是一款浏览器本地运行的在线 OCR 文字识别工具,所有识别运算全部在本机浏览器内完成,图片、PDF 文件不会上传至外部服务器,数据不会对外传输,可保护文档隐私。
主要功能
- 文件识别:支持图片以及多页扫描版 PDF 进行文字识别,支持批量上传多张图片、批量 PDF 识别,识别过程可设置进度提示,PDF 支持跳转指定页码识别。
- 多语言识别:支持多达 76‑80 种不同国家与地区的语言,包含简体中文、繁体中文、英文等常用语种。
- 结果处理:识别结果可以自由选中复制、点击复制;支持识别内容搜索;可导出 TXT、JSON 文本格式,还能把 PDF 识别结果导出为可搜索 PDF;软件会在本地保存 OCR 识别历史记录,方便回看之前识别的内容。
- 辅助能力:支持图片旋转识别;可以调整识别速度;支持过滤低置信度的识别结果;界面提供简体中文、繁体中文等多语言界面。
是否免费
网页全部核心 OCR 识别功能完全免费使用,无识别次数限制,无需注册登录账号,打开浏览器就可以直接使用。
是否好用
✅优点:
- 本地运算,文件不上传服务器,处理敏感截图、内部 PDF 相对安全;
- 支持 PDF 与批量图片识别,支持导出可搜索 PDF;
- 不用注册,没有识别次数限制;
- 自带识别历史记录,方便二次查阅识别内容。
⚠️局限:
- 仅输出文本类格式,不支持导出 Word、Excel 这类办公文档;
- 识别效果依赖浏览器加载语言包,首次打开会下载语言包,需要等待;
- 对手写文字、排版混乱、模糊低清晰度图片识别效果有限;
- 部分移动端浏览器功能会存在兼容性问题。
整体适合做印刷体图片、扫描 PDF 的文字提取,隐私优先,实用性较强。
适用人群
- 学生:提取讲义、课件截图、扫描 PDF 中的文字,省去手动抄录;
- 职场办公人员:对内部、敏感截图、扫描文档提取文字,不希望文件外传;
- 研究人员:批量处理扫描资料,导出文本用于整理笔记;
- 有隐私顾虑,不愿意把图片 / PDF 上传第三方服务器做 OCR 识别的用户。