Umi-OCR 离线 OCR 实测:解压即用,截图到批量 PDF 全流程拆解 Umi-OCR 离线 OCR 实测解压即用截图到批量 PDF 全流程拆解【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR周五下午你手边摊着十几张扫描的合同图片、一段网页里想抄下来的代码截图还有一本 PDF 作业等着批注——想把文字提出来又不想把东西传去在线服务。Umi-OCR 是一款免费、完全离线的 OCR 软件所有识别在本地跑完不联网、不上传。一个装进压缩包的 OCR 工具箱Umi-OCR 本质上是一个本地 OCR 工具箱截图、拖图、丢 PDF 进去它把文字吐给你。三个跟同类工具的差异点全程离线不依赖任何云服务免安装解压后双击Umi-OCR.exe就跑批量没有数量上限几百张图一次丢进去都行。主界面是标签页结构截图 OCR、批量 OCR、文档识别、二维码、全局设置按需打开互不干扰。解压后 30 秒跑通 拿到.7z发布包三下就够→ 解压到任意目录别丢 C 盘根目录免得跟系统文件混 → 双击Umi-OCR.exe首次启动自动按系统语言切换界面 → 默认打开「截图OCR」标签页鼠标框选屏幕任意区域即可识别平台要求Windows 7 x64 及以上、Linux x64无需安装运行库没有必配项。截图识别后右侧记录栏可直接右键复制、全选也支持划选多条记录一起复制。三件事让它替你干 代码和文档截图框一下就抄下来网页里有一段 Python 代码想保存或者 PPT 里的文字想提取到文档——在「截图OCR」标签页按快捷键唤起截图 → 框选目标区域 → 右侧记录区出结果右键CtrlC即可粘走。识别结果带置信度标记低于阈值的会高亮提示你复核。一整个文件夹的扫描图丢进去等结果就行月底报销一整个文件夹的发票截图要提取金额和日期——切到「批量OCR」标签 → 把文件夹整个拖进左侧列表 → 点「开始任务」。逐张识别结果默认存为txt也可选jsonl、csvExcel 可直接打开。没有数量上限几百张图排着队跑完跑完还能自动关机或待机。扫描版 PDF 变可搜索文档一本纯扫描的 PDF想全文搜违约两个字——打开「文档识别」标签 → 添加 PDF 文件 → 输出类型选「双层可搜索PDF」跑完得到一个新文件原图在底下识别文字浮在上面能搜、能复制外观不变。支持pdf、epub、mobi、cbz等格式还能设忽略区域排除页眉页脚。几个让识别更准的开关 排版解析方案识别代码截图时在页面设置里选单栏-保留缩进行首空格不会丢识别多栏新闻稿选多栏-按自然段换行段落不会串行。忽略区域图片角落有水印、LOGO 干扰结果在批量页右侧设置里打开忽略区域编辑器按住右键画矩形框框内文字直接跳过。大图/长图被截断页面设置 → 文字识别 →限制图像边长把数值调高超长截图就不会只识别上半截。界面闪烁或错位全局设置 → 界面和外观 →渲染器切换渲染方案或关闭硬件加速老显卡尤其有用。想接进自己的脚本 ️命令行入口就是主程序本身umi-ocr --screenshot --clip umi-ocr --path D:/img --output res.txtHTTP 接口默认开启仅本地回环图片 OCR、文档识别、二维码都有对应端点具体参数见 命令行手册 和 HTTP 接口手册。OCR 引擎可切换PaddleOCR/RapidOCR通过插件导入即可不用重装。两个高频疑问问识别繁体或日文文档准不准 答在对应标签页的语言下拉框切换到繁體中文或日本語内置语言库直接生效。问离线识别会不会比在线服务慢很多 答单张图通常 1 秒内出结果瓶颈在图片尺寸——边长超过 4000px 的大图先压缩再跑会明显提速。剩下的解压跑起来就知道了。完整更新记录在 CHANGE_LOG从哪一版加了什么功能、修了什么 bug一查便知。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考