
截图OCR、批量转文字、扫描PDF可搜索Umi-OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源免费的离线 OCR 工具负责三件日常的事截图取字、图片批量转文字、扫描件 PDF 提文本。不需要联网图片在你自己的电脑上完成处理不会上传到任何服务器。解压就能用全程不用安装。它替谁解决了什么问题你想引用屏幕上的一段文字但软件或论文阅读器不允许选中一个字一个字敲太费时间。文件夹里躺着几十张扫描发票文字要进表格归档逐张手录要花一整天。扫描版 PDF 的搜索框永远为空连术语出现在第几页都查不到。上手从下载到第一次跑通 获取发行包.7z压缩包或.7z.exe自解压包后者没装压缩软件也能直接解压。解压到任意目录不需要安装步骤。启动Windows 双击Umi-OCR.exeLinux 运行启动脚本umi-ocr.sh。首次打开时界面语言跟随系统。想换语言或主题进「全局设置」→「语言 / Language」「主题」亮色、暗色多套可选。完成第一次识别打开「截图OCR」标签页按快捷键框选屏幕上的文字或把别处复制的图片直接粘贴进来文字会输出到右侧记录栏可编辑、可多选复制。想从源码构建的话git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR再按 README 里的「构建项目」一节配置对应系统的环境。实操演示把一文件夹扫描图片批量转成文字背景文件夹里有几十张 jpg 格式的发票扫描图要把文字整理进 Excel。打开「批量OCR」标签页把整个文件夹拖到页面上图片会全部进入任务列表jpg、png、webp、bmp、tif 都支持数量没有上限。在右栏「设置」里核对识别语言如果每张图都有水印进「忽略区域」编辑器按住右键在图上画矩形把水印圈住框内的整个文本块会被直接跳过。点击「开始任务」等进度条走完列表会显示每张图的耗时和状态。勾选保存格式txt、jsonl、md、csv 四种任选其中 csv 能直接进 Excel。跑完之后每张图对应一份结果文件右侧「记录」栏里随时可以查看和复制。排错提示某张图错字多先把图片对比度调高再识别还不行就核对识别语言是否选对最后换另一套内置引擎重跑一遍。超大长图跑得极慢在页面「设置」→「文字识别」里把「限制图像边长」调高该值默认 960数值越小图片被压缩得越狠、速度越快但精度越差。忽略区域只跳过完全落在框内的整个文本块所以矩形要比水印画得稍大一些。其余能力速查 文档识别支持 pdf、xps、epub、mobi、fb2、cbz 六种文件可输出保留原图、再叠一层文字的双层 PDF之后既能搜索也能复制。二维码读取覆盖一维条码、PDF417 等共 19 种协议生成时可指定宽高和纠错等级。能力解决什么问题入口方式截图OCR拿走屏幕上的文字快捷键框选或粘贴图片文档识别扫描件变可搜索「文档识别」拖入 pdf 等二维码 / 条形码批量读码、生成码「二维码」页拖入图片排版解析多栏文本、代码缩进识别页「设置」里换方案忽略区域水印、页眉页脚批量页按住右键画框自动关机大任务过夜跑任务完成后勾选关机 / 休眠进阶命令行与 HTTP 接口命令行入口就是主程序本身把整个文件夹的识别结果写进一个文件一条命令umi-ocr --path D:/images --output D:/result.txt程序还自带本地 HTTP 接口默认端口 1224主机默认仅本地。发一张图片识别请求即可跑通import base64, json, requests b64 base64.b64encode(open(a.png, rb).read()).decode() r requests.post(http://127.0.0.1:1224/api/ocr, json{base64: b64, options: {data.format: text}}) print(json.loads(r.text)[data])参数细节看命令行手册和 HTTP接口手册。它是怎么工作的识别由内置的离线引擎完成提供 RapidOCR 和 PaddleOCR 两套可在「全局设置」里切换。整个流程运行在你自己的电脑上图片和文字不离开本机。HTTP 接口只走 127.0.0.1 的本地环回不经过物理网卡。适用边界与常见坑识别率受输入质量限制艺术字、潦草手写有上限调参数救不了。HTTP 接口对并发支持差脚本里请串行调用长时间大批量连续调用偶尔会报连接错误重新发请求即可。识别语言库覆盖简中、繁中、英、日、韩、俄等常用语言列表里没有的小语种内容建议换另一套引擎核对结果。大文件、超长图吃内存减少单批数量或调低「限制图像边长」的数值。仅支持 Windows x64Win7 及以上与 Linux x64没有 macOS 版。截图取字、批量转文字、扫描件提文本、二维码读写这四件事都在这一个离线工具里。想深入了解看下面的资源项目说明与发行版下载README.md命令行手册docs/README_CLI.mdHTTP 接口手册docs/http/README.md更新日志CHANGE_LOG.md遇到 Bug 或功能建议去项目 issue 区提 Issue【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考