Windows 桌面应用 · 识别在本机完成

把图片拖进来,
文字立刻出来

GTC 桌面 OCR 是一款 Windows 图片与 PDF 文字识别工具。截图、发票、扫描件、书页——拖进来就能复制或导出,全程离线,你的图片不会上传到任何地方。

免安装 · 解压即用 模型按需下载 16 MB 中文 / 英文 / 多语种 PDF 按页范围识别
GTC 桌面 OCR — manifesto.png
GTC 桌面 OCR 识别《共产党宣言》书页的界面截图,左侧书页上每行文字都框了出来,右侧是识别出的文字
Live demo

识别过程,一帧一帧给你看

下面这一页《共产党宣言》的结尾是真实样例:图是排好的书页,框和文字都是 GTC 桌面 OCR 跑出来的结果,不是手打的。

manifesto.png · 900 × 620 准备就绪
用于演示的书页:《共产党宣言》第二章结尾一节,共十一行正文
识别结果
13 行 · 232 字 · 模型 PP-OCRv5 多语种 · 本机 CPU 约 2~3 秒

真实软件里的进度是分阶段报的:定位文字 → 判断方向 → 识别文字,中途可以取消。

Features

该有的都有,不该有的不加

只做一件事:把图里的字变成你能直接用的文本。

拖进来就完事

图片和 PDF 直接从资源管理器拖进窗口,松手就载入;截图用 Ctrl+V 粘贴即可。

拖拽 / 粘贴 / 打开

PDF 逐页识别

上一页 / 下一页按钮加页码输入框,翻到哪页看哪页,也能只识别其中几页。

翻页 / 选页

结果实时追加

多页识别时右侧文字边跑边长,完成一页就出现一页,不用干等到最后。

实时

模型在线下载

识别模型不焊死在程序里。首次运行点一下下载约 16 MB,之后完全离线。

按需下载

看得见进度

图片上扫过一道扫描线,框逐个浮现,进度条按阶段报数,随时能取消。

扫描动画

一键取用

复制进剪贴板,或导出 txt / Markdown / JSON。JSON 里每行带坐标和置信度。

复制 / 导出

图片不出电脑

除了下载模型那一次联网,识别全程在本地 CPU 上跑,不上传、不统计、不登录。

完全离线

两套模型可换

PP-OCRv4 中英默认,PP-OCRv5 多语种精度更高。在模型管理里点一下就切。

v4 / v5
How to use

三步,从图片到文本

STEP 01

下载模型

第一次打开会停在引导页,点「下载」拉取约 16 MB 的识别模型。这一步做完,后面都不用再联网。

STEP 02

放进来

拖图片进窗口、按 Ctrl + O 选文件、Ctrl + V 粘贴截图,或打开一份 PDF。

STEP 03

开始识别

按 Ctrl + R 或点「开始识别」。跑完直接 复制,或导出成文件。

Models

两个模型包,按需选

都不随程序分发,用哪个下哪个;下载时会校验 SHA-256,坏了会自动丢弃重下。

模型包体积语言什么时候选它
PP-OCRv4 中英16.2 MB中文 + 英文默认。日常截图、文档、票据够用。
PP-OCRv5 多语种22.0 MB中文 + 英文 + 更多语种实测精度更高,英文词间空格保留更完整。

页面演示用的就是 v5:一张 900 × 620 的书页,识别出 13 行 232 字、平均置信度 0.91,本机 CPU 耗时 2~3 秒。速度会随图片尺寸变化。

Download

免费下载

免安装,解压后双击即可运行。

GTC 桌面 OCR 图标

GTC 桌面 OCR

Windows 10 / 11 · 64 位 免安装 识别完全离线 免费

下载后解压整个文件夹,双击 GTC-OCR\GTC-OCR.exe 即可运行。
第一次运行点「下载模型」(约 16 MB),之后断网也能正常识别。

下载压缩包 ZIP · 约 115 MB · Windows 64 位
Before you install

几点先说清楚

会弹「Windows 已保护你的电脑」

程序没有代码签名,SmartScreen 可能拦一次。点「更多信息」→「仍要运行」即可,之后不再弹。

第一次要联网

模型不打包在程序里,首次要点一下下载(约 16 MB)。之后即使断网也能正常识别。

报 DLL 加载失败

发布包已带 msvcp140 / vcruntime140。若仍提示缺少运行库,装一次「Microsoft Visual C++ 2015-2022 Redistributable (x64)」。

准确率看图片质量

小字号、模糊、倾斜、低对比度的图会掉准确率。遇到漏字,换 v5 模型或把图放大再识别。