GI
SOFTWARE

gImageReader

gImageReader 是 Tesseract OCR 的跨平台图形界面,可从图片、PDF、扫描设备、剪贴板和截图导入内容,支持批量识别、手动或自动划分区域、纯文本与 hOCR 输出、拼写检查和可搜索 PDF 生成。

版本 3.4.3Windows x86/x64LinuxGPL-3.0

适合做什么

gImageReader 适合把扫描书页、票据、图片型 PDF、截图和扫描设备输入转成可编辑文字或带文字层的 PDF。它把 Tesseract 的命令行能力放进图形界面,便于划分区域、批量处理、对照校对和组织 hOCR,但不是面向手写识别、复杂表格还原或高保真版式重建的万能工具。

当前版本与平台

3.4.3 于 2025-08-04 发布,Windows 提供 Qt 6 的 32 位、64 位安装包和便携包,Linux 可通过发行版软件包、Flatpak 或源码构建使用。该版本重点修复词典映射、PDF 打印异常、Qt 选择操作和 hOCR 树崩溃;没有发布方提供的 macOS 成品包。

识别质量与数据边界

识别由 Tesseract 与所选语言数据完成,图像质量、旋转、分栏、字体和区域顺序都会影响结果。纯文本会丢失大量布局,hOCR 和可搜索 PDF 可以保留坐标关系但仍需校对;程序许可证不改变原始文档的版权、隐私或保密要求。

维护记录

本页依据 3.4.3 发布记录、项目功能清单、平台安装说明与 GPL-3.0 许可核对,检查日期为 2026-08-06。

DOWNLOAD

选择下载方式

链接最近检查:2026-08-06

下载前请核对资源版本和授权范围。本站不提供破解软件及未经授权的资料。

GUIDE

gImageReader 3.4.3 安装、中文 OCR 与可搜索 PDF 教程

先安装与系统架构匹配的程序和 Tesseract 语言数据,再用少量清晰页面验证方向、分栏和识别区域,完成校对后分别保存原图、文本、hOCR 或可搜索 PDF。

安装前准备

  • 确认使用 Windows 32/64 位构建或受支持的 Linux 软件包;Windows 3.4.3 构建已转为 Qt 6,旧系统应先验证兼容性。
  • 准备原始图片或 PDF 副本,优先使用方向正确、对比度足够且文字边缘清晰的扫描件,不要在唯一原件上直接批量处理。
  • 确认 Tesseract 和所需语言数据已经安装;中英混排需要同时启用对应语言,但语言越多不代表识别一定更准。
01

安装步骤

  1. 01

    安装程序与 OCR 组件

    Windows 选择 x86 或 x64 安装包/便携包,Linux 使用系统软件包或 Flatpak;首次启动后检查 Tesseract 可执行文件、版本和语言列表。

  2. 02

    导入小样并设置语言

    先导入两三页具有代表性的图片或 PDF,修正方向和裁剪范围,选择主要语言与页面分割方式,再运行自动区域检测。

  3. 03

    校验输出链路

    分别测试纯文本与 hOCR 识别,抽查专有名词、数字、表格和段落顺序,再生成测试 PDF,验证搜索、复制和打印。

02

快速上手

  1. 01

    划分识别区域

    对单栏页面可先自动检测;双栏、图片说明、页眉页脚或表格应手动拆分区域,并按阅读顺序检查区域排列。

  2. 02

    识别并逐段校对

    在图像旁对照识别结果,利用拼写检查定位可疑词,但人名、术语、编号和金额必须回看原图,不能盲目接受自动修正。

  3. 03

    导出并保留来源

    根据用途保存纯文本、hOCR 或可搜索 PDF,同时保留原文件、语言设置和校对记录,重要资料再由第二人抽样复核。

使用建议

  • 3.4.3 修复拉丁语词典映射、打印 PDF 异常、Qt 鼠标选择空白页和 hOCR 树新增行崩溃,并把 Windows 构建切换到 Qt 6。
  • OCR 是概率识别,不应把结果当作原文证明;金额、日期、证件号、公式和脚注应逐项对照,必要时保留页码与坐标。
  • 大型 PDF 可分批导入,避免一次识别占满内存;先确定一套稳定的语言、分割和预处理参数,再批量应用。
  • 扫描件可能含个人信息或受版权保护内容;本地处理仍需限制文件权限、临时目录和导出副本的传播范围。
故障排查与卸载方法

语言列表里没有中文或其他目标语言怎么办?

检查 Tesseract 语言数据目录和程序实际调用的 Tesseract 实例,安装对应训练数据后重启;便携版、系统版和 Flatpak 可能读取不同目录,不要只看系统终端的语言列表。

PDF 无法打印、导出或页面顺序异常怎么办?

先升级到 3.4.3,用少量页面和默认参数复测;确认源 PDF 未加密或损坏,检查磁盘空间与写入权限,并把复杂页面拆分后重新生成。

  1. 归档识别结果与参数保存原件、最终文本/PDF、语言选择和必要的 hOCR 项目,确认导出文件可以独立打开后再清理工作目录。
  2. 移除程序与可选语言数据卸载应用或删除便携目录;Tesseract 与语言数据可能被其他 OCR 工具共用,确认没有依赖后再移除缓存和训练数据。
FAQ

常见问题

gImageReader 本身就是 OCR 引擎吗?

不是。gImageReader 负责导入、划分识别区域、调用识别、校对和导出,真正的字符识别由 Tesseract 完成。程序能否识别某种语言、识别质量和训练数据版本,都取决于已安装的 Tesseract 及对应语言数据。

为什么中文页面识别成乱码或大量错误?

先确认选择了正确的简体或繁体语言数据,再检查图片方向、分辨率、对比度、版面分栏和区域划分。低清压缩图、艺术字体、手写体、竖排文字和复杂表格都可能明显降低准确率,不能只靠反复点击识别解决。

生成可搜索 PDF 会改变原始页面吗?

hOCR 导出的 PDF 通常把页面图像与文字层组合,外观可能接近原稿,但文字坐标、字体替代、压缩和页面尺寸仍需抽查。法律、财务或档案材料应保留原文件,并验证复制、搜索和打印结果。

下载时需要提取码吗?

夸克网盘无需提取码;百度网盘所需的四位提取码会直接显示在下载入口旁。