
Umi-OCR 免费离线OCR完全教程Win7老电脑3步装好截图、批量识别全支持【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR如果你还有一台装着 Windows 7 的旧台式机想让屏幕里的文字一键变成可复制的文本不妨试试Umi-OCR——这是一款完全免费、开源于 GitHub 的离线OCR文字识别工具断网状态下也能把截图、成批的图片甚至扫描版 PDF 里的字抠出来识别结果直接落到剪贴板或文件里不经过任何第三方服务器。下面这篇教程按准备环境 → 装好软件 → 跑通功能 → 解决毛病的顺序走一遍全程不堆参数只讲你实际要点的按钮和要看的现象。为什么这台免费离线OCR值得装到老电脑上它到底是什么Umi-OCR 把 OCROptical Character Recognition光学字符识别即看图识字引擎整个打包进了一个绿色程序里解压即用全程不需要联网。官方明确标注支持Windows 7 x64及更新的系统也提供 Linux x64 版本。三个核心亮点对应三类常见需求截图即识别框选一下屏幕文字就出现在识别记录里适合从视频、网页、软件界面里抠字批量处理一次拖入几百张图片可以排除水印和页眉页脚区域结果按 txt、csvExcel、jsonl 等格式落盘适合票据、文档扫描件整理识别语言内置中文、繁体、英文、日文等多国语言库随包附带界面本身也支持多语言首次启动会跟随系统语言自动切换不用单独下载语言包。适用场景偶尔提取屏幕文字、批量整理扫描图片、给 PDF 加可搜索文本层、顺带扫一下二维码/生成二维码——这些是它最趁手的活。不太合适的场景你的系统是32 位Windows 7运行环境已转向 64 位不再兼容 32 位、你用的是 macOS、或者你需要云端级别的超大并发识别能力。这三种情况请另选工具。动手前把环境准备清单过一遍项目要求说明操作系统Windows 7SP1 64 位及以上 / Linux x64先按winver确认系统版本和位数32 位系统无法运行运行库Visual C 2015-2022 可再发行组件包x64老系统常见缺失项提前装好可少走弯路系统更新Windows 7 建议补齐 SP1 及后续安全更新部分底层 API 依赖较新的系统组件磁盘空间预留约 1GB 空闲程序本体 OCR 引擎模型文件硬件双核 CPU、4GB 内存以上体验更佳低配机器可用只是批量任务会慢一些获取方式二选一下载发行版推荐普通用户从项目的发布页下载.7z压缩包如果目标电脑没装压缩软件选.7z.exe自解压包双击就能解压。包名类似Umi-OCR_Rapid_v2.1.5.7z其中Rapid表示内置 RapidOCR 引擎兼容性优先。克隆源码仓库适合想研究或参与开发的人执行下面的命令拉取一个稳定的发布分支git clone --single-branch --branch release/2.1.4 https://gitcode.com/GitHub_Trending/um/Umi-OCR4步装好从下载到第一次识别成功第 1 步把压缩包放到一个干净的路径把下载的 7z 包放到不含中文和空格的目录例如D:\Tools\。这是为了避免个别运行库组件在奇怪路径下出怪问题。验证文件管理器里能看到这个压缩包且路径全是英文字符。第 2 步解压认准主程序用 7-Zip 或自解压包解压。解压完成后目录里应能看到主程序Umi-OCR.exe和一个叫UmiOCR-data的文件夹里面是引擎、插件和界面资源。验证Umi-OCR.exe与UmiOCR-data两个都存在才算解压完整。第 3 步双击启动看语言对不对双击Umi-OCR.exe。首次启动程序会自动生成默认配置保存在UmiOCR-data/.settings。检查界面是否按你的系统语言显示成中文如果不是去全局设置 → 语言/Language手动切换一下。验证主窗口正常打开标签栏出现截图OCR / 批量OCR / 文档识别等标签页文字无乱码。第 4 步跑一次冒烟测试在截图OCR标签页按默认快捷键唤起截图框选屏幕上任意一段文字松开鼠标。验证右侧识别记录栏里出现了你框选的文字点一下复制按钮就能粘贴到别处——做到这一步安装就算成功了。三个高频场景把截图OCR和批量识别用顺手截图OCR怎么设置一键框选屏幕文字入口打开截图OCR标签页。操作按快捷键唤起截图遮罩用鼠标框选目标区域也可以在别处复制一张图片直接粘贴进来识别。左侧是图片预览带文字框标注右侧是可编辑的识别记录支持跨多条记录划选复制。预期效果松开鼠标后一两秒内文字出现在记录栏点复制粘贴到 Word 或聊天框即是纯文本。文字顺序乱打开排版解析引擎的原始输出是按文字块给出的多栏文章、代码截图容易串行。在截图OCR页的设置里找到文本后处理 - 排版解析方案选多栏-按自然段换行适合绝大多数文章场景识别代码截图则选单栏-保留缩进。改完再识别一次段落顺序会明显变顺。如何开启批量图片识别一次处理几百张图入口打开批量OCR标签页。操作把图片支持 jpg、png、webp、bmp、tiff 等或整个文件夹直接拖进列表。若图片上带固定位置的水印或页眉点右栏设置进入忽略区域编辑器按住右键把水印位置框成大矩形——框内的文字会在任务中被整体跳过。然后选择输出格式txt / csv(Excel) / jsonl / md点开始任务还可以勾选任务完成后自动关机适合下班前挂一批图回家收结果。预期效果任务条逐张推进完成后在输出目录得到与图片同名的结果文件水印处的文字不再混入结果。小提示要识别特别长的长图时先到页面设置 → 文字识别 → 限制图像边长把数值调大否则超长图会被截断处理。文档识别和二维码顺手的隐藏技能文档识别在文档识别标签页拖入pdf也支持 epub、mobi 等可以提取 PDF 原有文本或对扫描件做 OCR 并输出双层可搜索 PDF上面是原文图层、下面藏着可检索的文字层页眉页脚同样可以用忽略区域排除。二维码二维码标签页既能扫截图、粘贴或拖入图片支持一图多码、19 种编码协议也能反向操作——输入文本生成二维码图片。避坑指南常见症状速查表症状可能原因解法双击Umi-OCR.exe报错提示缺少 DLL / 运行库错误系统缺少 VC 可再发行组件包安装Visual C 2015-2022x64Win7 用户同时确认 SP1 已装好、安全更新已补齐截图时屏幕闪烁、界面错位、控件重叠老显卡与默认硬件加速渲染不兼容进全局设置 → 界面和外观 → 渲染器换一种渲染方案或直接关闭硬件加速改完重启软件观察Win7 下文档识别打不开或报错旧版对 Win7 低配 CPU 的文档模块兼容问题升级到 v2.1.1 及以上版本该问题已修复见更新日志识别结果顺序混乱、段落串位使用了引擎原始输出未做排版整理在设置中启用排版解析多栏文章选多栏-按自然段换行水印、LOGO 文字混进批量结果没设忽略区域在批量OCR页右栏打开忽略区域编辑器把水印位置框大、框全再跑任务超长图识别结果不全图像边长超出默认限制调高限制图像边长数值第一次识别很慢之后正常引擎首次启动要加载模型文件属正常现象等待即可程序闲置约半分钟后会自动释放引擎内存不必担心占用命令行输入了指令却收不到结果主程序未运行或 HTTP 服务未开启保持 Umi-OCR 在后台运行确认全局设置中 HTTP 服务已允许默认开启主机选仅本地即可如果还想更进一步命令行党可以用Umi-OCR.exe --help查看所有指令如--screenshot、--path批量喂图进阶用户还能通过 HTTP 接口把它接进自己的自动化脚本详细用法看 命令行手册 和 HTTP接口手册。写在最后更新与进阶资料去哪看Umi-OCR 的思路其实很朴素把看图识字这件事彻底搬进本地免费、断网可用、老电脑也能跑——对 Win7 64 位用户来说它至今仍是一台被持续维护的离线OCR工具。日常使用记住三件事就够了装对运行库、遇到界面异常就切渲染器、批量任务先画忽略区域。后续想要新功能动态或排错依据可以常翻三处资料项目说明见 README历次改动记录见 更新日志需要外部调用则参考 docs/http/README.md。版本发布节奏不快但稳定隔几个月回来检查一次更新日志通常都能收获一批兼容性修复。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考