5分钟识别100张图片的文字:Umi-OCR离线OCR实操指南 5分钟识别100张图片的文字Umi-OCR离线OCR实操指南【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR你需要从一堆扫描图片和截图中提取文字时打开 Umi-OCR一次性导入结果可以直接存成 txt、Markdown 或 Excel。Umi-OCR 是一款免费、开源、离线运行的批量 OCR 软件全程在本地完成不联网内置中文、英文等多语言识别库。快速认识这款离线 OCR 软件能干什么Umi-OCR 采用标签页式界面支持 Windows 7 x64 与 Linux x64识别引擎为内置的 PaddleOCR 和 RapidOCR 二选一在全局设置中切换。它覆盖四类任务截图识别、批量图片识别、文档识别、二维码扫描与生成除图形界面外还提供命令行和 HTTP 接口。整理扫描教材的学生、批量处理截图的办公人员、想在程序里调用识别能力的开发者都能在里面找到入口。对比项云端 OCR 服务Umi-OCR网络需联网图片上传到服务器本地运行无需联网费用按识别量收费免费、开源批量能力受服务限流约束无数量上限可导入几百张图使用形态网页或 SDK标签页界面 命令行 HTTP 接口Umi-OCR 主界面截图OCR、批量OCR、全局设置各自独立成标签页按需打开快速上手从导入图片到输出文字的3步第1步解压启动。发行版是 7z 压缩包解压后双击Umi-OCR.exe即可运行免安装免注册。首次启动时界面语言自动跟随系统设置想换语言去全局设置→语言/Language切换。第2步选图导入。打开批量OCR标签页点左上角选择图片多选 jpg、png、bmp、webp、tif 等格式的本地图片列表会显示在左侧数量不设上限。第3步跑任务并保存。点开始任务软件按列表顺序逐张识别列表上显示每张图的耗时与置信度文字实时出现在右侧“记录”区。完成后保存可选 txt、md、jsonl、csv(Excel) 四种格式。批量OCR标签页左侧列表给出每张图的耗时与置信度右侧展示识别结果一键开始任务 图片特别多时可以在设置里勾选“自动关机/待机”任务跑完电脑自动睡眠适合挂机处理大批文件。场景实战3个典型用法三个常用标签页的输入输出速查标签页支持的输入能得到什么批量OCRjpg、png、webp、bmp、tif 等图片txt、md、jsonl、csv(Excel)文档识别pdf、xps、epub、mobi、fb2、cbz双层可搜索PDF、文本二维码截图/粘贴/拖入的图片扫码内容、二维码图片场景一把 PDF 变成可搜索版场景扫描版书籍或合同是纯图片文字选不中。关键操作打开文档识别标签页导入 pdf、xps 或 epub 文件用忽略区域框掉页眉页脚启动任务后选择保存为双层可搜索PDF。得到什么既能看原版页面又能直接搜索和选中文字的文件。场景二截图一键取文字场景在别的软件里看到一段文字想立刻复制。关键操作打开截图OCR标签页用快捷键唤起截图划选完成后右侧“记录”出现文字右键复制或复制全部即可从别处复制的图片也能直接粘贴进来识别。得到什么文字直接进入剪贴板不用再存图、开图。截图OCR标签页左侧是图片预览右侧是识别记录右键可复制、删除记录场景三扫码与生成二维码场景图片里有二维码或条形码要读出内容或需要把一段文本生成二维码图片。关键操作打开二维码标签页。扫描侧支持截图、粘贴、拖入图片一张图里多个码也能识别生成侧支持 QRCode、Code128 等 19 种编码协议还能设置纠错等级。得到什么扫码内容直接列出生成的二维码图片可保存使用。进阶技巧3处参数调整让识别更准技巧1用“忽略区域”剔除干扰。图片带水印或页码时在批量OCR页右栏设置里打开忽略区域编辑器按住鼠标右键画矩形框框内文字会被整块跳过。框尽量画大些、完全包住水印位置注意只有完整落在框内的文本块才会被忽略。技巧2长文识别选对“排版解析方案”。文本后处理里的排版解析方案会自动处理横排和竖排文字排版解析方案适用材料效果多栏-按自然段换行论文、双栏排版识别栏位按段落换行单栏-保留缩进代码截图保留行首缩进与空格多栏-无换行网页类文字把语句合并到一行不做处理需要原始输出引擎原始结果技巧3大图与界面异常去全局设置处理。图片边长超过默认的限制图像边长时引擎会缩小图片高清扫描件若识别不完整去页面设置→文字识别→限制图像边长调高数值再跑一次。在全局设置里可切换 PaddleOCR/RapidOCR 引擎后者速度稍快若出现截屏闪烁、界面错位把界面和外观下的渲染器换成另一种渲染方案即可。全局设置标签页可切换语言、主题、字体管理桌面快捷方式与开机自启常见问题Q1批量任务进度很慢。现象进度条推进慢。原因识别耗时受图片数量和分辨率影响高 DPI 大图尤慢。处理把一批图拆成多批跑分辨率很高的图可把限制图像边长适当调低换取单张速度。Q2长图只识别出一部分。现象很高的截图或长文档图片文字缺失。原因图片边长超过默认限制图像边长引擎先缩小了图片。处理到页面设置→文字识别→限制图像边长调高数值重新发起任务。Q3结果里混入水印文字。现象识别结果总带固定位置的水印、logo 或页码。原因没有给图片配置忽略区域。处理在忽略区域编辑器里按住右键画框之后这些位置会被自动跳过。Q4命令行没有响应。现象执行umi-ocr --screenshot等指令没反应。原因命令行依赖本地 HTTP 服务做进程间通信服务被关掉就无法执行。处理在全局设置里确认 HTTP 服务已开启默认开启主机选仅本地再重新执行。资源与扩展命令行手册docs/README_CLI.md--screenshot、--path、--output等指令说明HTTP 接口手册docs/http/README.md本地服务默认地址为http://127.0.0.1:1224接口参数速查docs/http/api_doc.md含参数查询、图片OCR、文档识别完整流程示例代码docs/http/api_doc_demo.py一个可运行的 Python 文档识别示例翻译工具dev-tools/i18n/参与界面翻译的脚本与说明更新日志CHANGE_LOG.md最快的路径是解压、打开、选择图片、开始任务第一批识别结果就出来了。先导几张截图试试排版解析方案和忽略区域它会越用越顺手。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考