公司动态
Umi-OCR 完整入门指南:免费离线批量 OCR,3 步完成首次识别
Umi-OCR 完整入门指南免费离线批量 OCR3 步完成首次识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、可离线运行的 OCR光学字符识别即从图片中提取文字软件。图片与结果全程不出本机支持截图识别、批量导入图片、PDF 文档识别和二维码扫描/生成内置中文、英文、日文等多国语言识别库。本文面向新手和普通办公用户按安装、首次识别、核心场景与常用参数依次展开。Umi-OCR 是什么截图、批量、PDF 三种识别一体Umi-OCR 的定位是解压即用的离线文字识别工具解决从截图、扫描件、PDF 中提取文字的需求且无需把图片上传到云端。适用于 Windows含 Windows 7 x64和 Linux x64。功能清单一行一项截图 OCR快捷键截取屏幕任意区域识别也支持粘贴图片识别结果可划选复制批量 OCR一次导入几百张 jpg/png/bmp/tif 等图片结果保存为 txt、md、csv(Excel)、jsonl文档识别识别 PDF 等扫描件可输出双层可搜索 PDF二维码读取图片中的 19 种码制也可输入文本生成二维码图片全局设置界面语言、主题、OCR 引擎切换安装与首次运行3 步完成第一次文字识别 Umi-OCR 以.7z压缩包或自解压包发布无需安装步骤。获取发布包从项目的发行版页面下载对应系统的压缩包解压到一个固定目录。启动程序直接运行解压目录里的Umi-OCR.exeLinux 下为umi-ocr.sh。界面语言会按系统设置自动切换也可在全局设置里手动修改。完成首次识别打开截图 OCR页按快捷键框选屏幕上的一段文字识别结果立即显示在右侧记录栏可划选复制。若截图或界面出现闪烁、错位到全局设置→界面和外观中切换渲染器或关闭硬件加速即可。核心场景实操批量扫描件与代码截图两种任务任务一批量识别一文件夹的扫描件任务背景手头有几十张文档扫描图需要把全部文字提取出来存档。操作过程进入批量 OCR页点导入按钮选择图片所在文件夹左侧列表显示全部待处理图片。在右侧设置列选择后处理方案多栏-按自然段换行——扫描件多为分栏排版该方案能自动拆分栏并按自然段换行比原始输出更接近原文结构。设置输出格式txt 或 csv点开始任务列表实时显示每张图的进度。结果说明任务完成后每张图片对应一份结果文件。如果图片带水印或页码可在设置列进入忽略区域编辑器按住右键拖动画矩形框住水印位置框内文字块会在任务中被排除。任务二识别一张代码截图并保留缩进任务背景代码是截图形式需要把文字复制出来且保留缩进。操作过程进入截图 OCR页快捷键框选代码区域后处理方案选单栏-保留缩进该方案会保留行首缩进和行中空格适合代码场景。结果说明识别结果直接粘贴进编辑器即可用。如果不是代码多栏-按自然段换行是更通用的默认选择。常用参数说明排版解析方案与图像边长怎么配影响识别效果的主要是两类参数排版解析方案决定文字如何换行与排序图像边长限制决定大图如何缩放处理。参数所在位置什么时候调整后处理方案页面右栏-文字识别代码截图选单栏-保留缩进分栏文献选多栏-按自然段换行拿不准就用默认忽略区域批量页-设置图片有固定位置的水印、页眉页脚时画框覆盖后排除限制图像边长页面设置-文字识别识别像素很大的长图或大图时调高数值避免默认限制把图缩小、损失细节输出格式批量页-设置txt 便于直接阅读csv 可用 Excel 打开md 保留段落结构各方案都能自动处理横排和竖排从右到左排版但竖排文字还需要 OCR 引擎本身支持对应语言。常见问题速答识别速度明显偏慢。原因是图片像素过大或列表过长。把大图先缩小分辨率或把任务拆成几批分别运行处理时不要再叠加新任务。识别结果里混进水印和页眉。原因是忽略区域框没画够大——只有完整落入框内的整个文本块才会被忽略框小了会漏。把矩形画得完全包住水印可能出现的所有位置即可。截图时界面闪烁或 UI 错位。原因是显卡渲染兼容问题。到全局设置→界面和外观切换渲染器或关闭硬件加速。命令行输入后没有反应。原因是命令行依赖 HTTP 接口做跨进程通信该服务默认开启如果被手动关闭则指令无法送达。在全局设置中重新允许 HTTP 服务主机选仅本地即可。界面语言不是我想要的。首次启动按系统语言自动匹配系统语言不在支持列表时会回退默认语言。在全局设置→语言手动切换即可支持简中、繁中、英文、日文等。深入使用命令行与 HTTP 接口入口需要自动化时Umi-OCR 提供两种外部调用方式都通过本机回环通信不经过物理网卡命令行入口仍是主程序例如umi-ocr --path D:/img1.png --output result.txt可识别指定图片并保存结果还支持--screenshot、--clipboard等指令详见 docs/README_CLI.mdHTTP 接口向本地端口提交 Base64 图片即可获得识别结果适合写脚本或接入其他工具详见 docs/http/README.md其他入口更新日志见 CHANGE_LOG.md想参与界面翻译可看 dev-tools/README.md。下一步建议先在截图 OCR页认一张图再在批量 OCR页跑一个图片文件夹熟悉后处理方案与忽略区域这两项设置后多数场景的结果就能直接可用。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考