吾爱破解 - LCG - LSG |安卓破解|病毒分析|www.52pojie.cn

 找回密码
 注册[Register]

QQ登录

只需一步,快速开始

查看: 30214|回复: 808
收起左侧

[原创工具] Umi-OCR 免费 · 离线 · 文字识别软件 [支持PDF识别!]

    [复制链接]
Nagisa1224 发表于 2023-11-21 09:55
本帖最后由 Nagisa1224 于 2024-4-1 12:59 编辑

Umi-OCR 文字识别工具

免费,开源,批量,无限次数的离线OCR软件。
适用于 Windows7 x64 及以上。
现已支持PDF识别,输出双层可搜索PDF!

https://github.com/hiroi-sora/Umi-OCR

  • 免费:本项目所有代码开源,完全免费。
  • 方便:解压即用,离线运行,无需网络。
  • 高效:自带高效率的离线OCR引擎,内置多种语言识别库。
  • 灵活:支持命令行、HTTP接口等外部调用方式。
  • 功能:截图OCR / 批量OCR / PDF识别 / 二维码 / 公式识别(测试中

1-标题-2.png

下载发行版

以下发布链接均长期维护,提供最新软件版本。

开始使用

软件发布包下载为 .7z.exe 自解压包,可在没有安装压缩软件的电脑上解压。解压后,点击 Umi-OCR.exe 即可启动程序。

遇到任何问题,或者希望请求新功能,请提在 Github 发个 Issue ,我会尽可能帮助你。(不经常上52,可能错过你的消息。)

另:兼容 Windows 7 是一项困难的工作,因为很多第三方库都不支持了。我只能尽量确保在靠后的Win7版本(如7601.24545)能完美使用所有功能。

Windows 7 用户遇到异常可参考: 常见问题及修复方法

标签页

Umi-OCR v2 由一系列灵活好用的标签页组成。您可按照自己的喜好,打开需要的标签页。

标签栏左上角可以切换窗口置顶。右上角能够锁定标签页,以防止日常使用中误触关闭标签页。

截图OCR

截图OCR:打开这一页后,就可以用快捷键唤起截图,识别图中的文字。

  • 左侧的图片预览栏,可直接用鼠标划选复制。
  • 右侧的识别记录栏,可以编辑文字,允许划选多个记录复制。
  • 也支持在别处复制图片,粘贴到Umi-OCR进行识别。

文本后处理

关于 OCR文本后处理 - 排版解析方案: 可以整理OCR结果的排版和顺序,使文本更适合阅读和使用。预设方案:

  • 多栏-按自然段换行:适合大部分情景,自动识别多栏布局,按自然段规则进行换行。
  • 多栏-总是换行:每段语句都进行换行。
  • 多栏-无换行:强制将所有语句合并到同一行。
  • 单栏-按自然段换行/总是换行/无换行:与上述类似,不过 不区分多栏布局。
  • 单栏-保留缩进:适用于解析代码截图,保留行首缩进和行中空格。
  • 不做处理:OCR引擎的原始输出,默认每段语句都进行换行。

上述方案,均能自动处理横排和竖排(从右到左)的排版。(竖排文字还需要OCR引擎本身支持)


批量OCR

批量OCR:这一页用于批量导入本地图片进行识别。

  • 支持格式:jpg, jpe, jpeg, jfif, png, webp, bmp, tif, tiff
  • 保存识别结果的支持格式:txt, jsonl, md, csv(Excel)
  • 与截图OCR一样,支持文本后处理功能,整理OCR文本的排版和顺序。
  • 没有数量上限,可一次性导入几百张图片进行任务。
  • 支持任务完成后自动关机/待机。
  • 如果要识别像素超大的长图或大图,请调整:页面的设置→文字识别→限制图像边长→【调高数值】
  • 拥有特殊功能 忽略区域

忽略区域

关于 OCR文本后处理 - 忽略区域: 批量OCR中的一种特殊功能,适用于排除图片中的不想要的文字。

  • 在批量识别页的右栏设置中可进入忽略区域编辑器。
  • 如上方样例,图片顶部和右下角存在多个水印 / LOGO。如果批量识别这类图片,水印会对识别结果造成干扰。
  • 按住右键,绘制多个矩形框。这些区域内的文字将在任务中被忽略。
  • 请尽量将矩形框画得大一些,完全包裹住水印所有可能出现的位置。

文档识别

文档识别

  • 支持格式:pdf, xps, epub, mobi, fb2, cbz
  • 对扫描件进行OCR,或提取原有文本。可输出为 双层可搜索PDF
  • 支持设定 忽略区域 ,可用于排除页眉页脚的文字。
  • 可设置任务完成后 自动关机/休眠

二维码

扫码

  • 截图/粘贴/拖入本地图片,读取其中的二维码、条形码。
  • 支持一图多码。
  • 支持19种协议,如下:

Aztec,Codabar,Code128,Code39,Code93,DataBar,DataBarExpanded,DataMatrix,EAN13,EAN8,ITF,LinearCodes,MatrixCodes,MaxiCode,MicroQRCode,PDF417,QRCode,UPCA,UPCE

生成码

  • 输入文本,生成二维码图片。
  • 支持19种协议和纠错等级等参数。

全局设置

全局设置:在这里可以调整软件的全局参数。常用功能如下:

  • 一键添加快捷方式或设置开机自启。
  • 更改界面语言。Umi支持繁中、英语、日语等语言。
  • 切换界面主题。Umi拥有多个亮/暗主题。
  • 调整界面文字的大小字体
  • 切换OCR插件。
  • 渲染器:软件界面默认支持显卡加速渲染。如果在你的机器上出现截屏闪烁、UI错位的情况,请调整界面和外观渲染器 ,尝试切换到不同渲染方案,或关闭硬件加速。

调用接口:


关于项目结构

各仓库:

支持的离线OCR引擎:

运行环境框架:

构建项目

请见 GitHub主页

支持

Umi-OCR 完全免费,且暂时不接受打赏。

喜欢本项目,请在GitHub主页给个⭐,谢谢支持!

更新日志

👆 点击查看

免费评分

参与人数 310吾爱币 +313 热心值 +285 收起 理由
caoyisheng + 2 + 1 用心讨论,共获提升!
douliuyin + 1 + 1 谢谢@Thanks!
cjw666 + 1 + 1 谢谢@Thanks!
GodJoey + 1 + 1 我很赞同!
ggh2 + 1 + 1 我很赞同!
xhg2992 + 1 + 1 谢谢@Thanks!
38342175 + 2 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
清水心跳 + 1 + 1 谢谢@Thanks!
sd001 + 1 + 1 我很赞同!
nicheng + 1 热心回复!
尤里zlj + 1 + 1 谢谢@Thanks!
restart19 + 1 + 1 谢谢@Thanks!
大K + 1 + 1 谢谢@Thanks!
fxw622812128 + 1 + 1 鼓励转贴优秀软件安全工具和文档!
www0313 + 1 + 1 非常优秀
aoali + 1 + 1 谢谢@Thanks!
小师叔 + 1 + 1 用心讨论,共获提升!
zzttzhang + 1 + 1 谢谢@Thanks!
shilichun1982 + 1 + 1 我很赞同!
hnabc2003 + 1 + 1 鼓励转贴优秀软件安全工具和文档!
Sankaku + 1 谢谢@Thanks!
binguyue + 1 + 1 谢谢@Thanks!
constraint + 1 + 1 还在下载,感觉好用,都给你
Excel52 + 1 + 1 谢谢@Thanks!
n53618861 + 1 欢迎分析讨论交流,吾爱破解论坛有你更精彩!
Wang0663 + 1 + 1 我很赞同!
windofsummer + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
2h000 + 1 + 1 谢谢@Thanks!
houkunlin + 1 用心讨论,共获提升!
路过一位靓仔 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
xc120 + 1 + 1 谢谢@Thanks!
50466361 + 1 + 1 谢谢@Thanks!
阴凉 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
niwang6 + 1 + 1 软件很好用,再接再励
aAChengYay + 1 + 1 用心讨论,共获提升!
yantian007 + 1 + 1 谢谢@Thanks!
2015abc + 1 + 1 我很赞同!
linangong0616 + 1 + 1 谢谢@Thanks!
Gilbert + 1 + 1 谢谢@Thanks!
caiduyi127 + 2 + 1 谢谢@Thanks!
catoo1 + 1 我很赞同!
newyun + 1 + 1 我很赞同!
以光之魂 + 1 + 1 用心讨论,共获提升!
Small-Bao + 1 + 1 谢谢@Thanks!
ABF7470 + 1 + 1 我很赞同!
yycda + 1 + 1 谢谢@Thanks!
Kexiaoluo123 + 1 + 1 我很赞同!
lustig + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
gloryer0714 + 1 鼓励转贴优秀软件安全工具和文档!
Quixote + 1 + 1 我很赞同!
搭闩必 + 1 + 1 谢谢@Thanks!
泪之火 + 1 + 1 谢谢@Thanks!
xuxiansen + 1 + 1 我很赞同!
蓝风 + 2 + 1 是真的好用,比天若强很多
gzdiky + 1 + 1 识别软件,我最爱的一款
eddygao + 1 + 1 我很赞同!
jrn888 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
tyzzz + 1 + 1 谢谢@Thanks!
禾水木 + 1 + 1 热心回复!
rouroupojie + 1 + 1 谢谢@Thanks!
ct123456789 + 1 + 1 谢谢@Thanks!
Edison_zhu + 3 + 1 来晚了。比天若好用
tujssia + 1 + 1 鼓励转贴优秀软件安全工具和文档!
zhenze + 1 + 1 谢谢@Thanks!
tsyh23333 + 1 + 1 我很赞同!
kuizheng + 1 + 1 谢谢@Thanks!
初城 + 1 + 1 热心回复!
aiwuxianhenji + 1 + 1 谢谢@Thanks!
chj01 + 1 + 1 不错,感谢分享,收藏了。
平凡路 + 1 + 1 谢谢@Thanks!
willyork + 1 + 1 谢谢@Thanks!
dimliy + 1 + 1 鼓励原创优秀软!
wenrenmingyue + 1 谢谢@Thanks!
Umbrellagy + 1 + 1 谢谢@Thanks!
天夜ss + 1 + 1 我很赞同!
kyletian + 1 + 1 我很赞同!
henancappucc + 1 + 1 我很赞同!
小黑蛋 + 1 + 1 谢谢@Thanks!
三水之复制版 + 1 + 1 谢谢@Thanks!
leha001 + 1 + 1 谢谢@Thanks!
槐序小苎 + 1 + 1 谢谢@Thanks!
lds114 + 1 + 1 我很赞同!
本新 + 1 + 1 我很赞同!
dych1688 + 2 + 1 谢谢@Thanks!
cfx1108 + 1 + 1 我很赞同!
mb8315 + 1 + 1 我很赞同!
GarryGu + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
wushaopei + 1 我很赞同!
zai2006 + 1 谢谢@Thanks!
longfo + 1 + 1 谢谢@Thanks!
kyokusanagi2000 + 1 谢谢@Thanks!
Lanckie + 1 + 1 我很赞同!
hanloth + 1 + 1 谢谢@Thanks!
xh20011206 + 1 + 1 用心讨论,共获提升!
wanfeng304 + 1 + 1 谢谢@Thanks!
daemonlive + 1 + 1 我很赞同!
cwj1052 + 1 + 1 热心回复!
forzh1 + 1 + 1 我很赞同!
elvis2008 + 1 我很赞同!
lyhjh + 1 谢谢@Thanks!

查看全部评分

本帖被以下淘专辑推荐:

发帖前要善用论坛搜索功能,那里可能会有你要找的答案或者已经有人发布过相同内容了,请勿重复发帖。

secretji 发表于 2023-11-21 13:22
感谢分享,一直在用天若,回头试一下这个
 楼主| Nagisa1224 发表于 2023-12-2 20:40
l101 发表于 2023-12-2 17:37
我的电脑第三方程序调用运行结果
Umi-OCR_Paddle_v2.0.0
可以正常使用

Rapid与Paddle版,HTTP调用时填写的参数不同的哦,如果搞错了参数可能导致调用失败。

命令手册: https://github.com/hiroi-sora/Um ... 3%E7%A4%BA%E4%BE%8B

然后关于cmd无返回,这个可能是我这边的锅。由于运行环境的一些限制,会对管道输出流进行重定向,所以可能会影响调用方的获取。后续会改善这个问题。
 楼主| Nagisa1224 发表于 2023-11-22 11:47
BilboBaggins 发表于 2023-11-21 21:52
任务管理器里也没有,Paddle 和 Rapid 两个都试了,均无反应

试一下:打开文件夹 UmiOCR-data ,点击其中的 RUN_CLI.bat ,看看有无反应?如果有报错的话把报错贴上来。

如果没有报错并且能正确显示软件界面,那么可以用 RUN_GUI.bat 来启动软件。

RUN_.bat 是备用启动器,比主启动器 Umi-OCR.exe 的兼容性更好。

如果可以的话,后续结果到GitHub上发个Issue给我。52论坛这边我可能不会经常看。
 楼主| Nagisa1224 发表于 2023-11-23 10:27
snowyibb 发表于 2023-11-23 09:34
对了,我发现好像中英混排容易把那个空格自动删除,但是纯粹是英文的时候,通常都有空格。

请问大佬怎么 ...

这是PaddleOCR离线引擎的祖传问题了,暂时没有好的解决方法,如果要识别长篇英文段落那就切换到纯英文库吧。

以后会增加更多离线引擎,用户可自己选择更适合的。
 楼主| Nagisa1224 发表于 2023-11-23 16:32
最忆是江南 发表于 2023-11-23 11:50
添加 开机启动失败。 管理员允许也不行。

是否为win7?有没有啥报错?

你可以手动添加开机启动:
1. 添加一个桌面快捷方式
2. 将快捷方式扔到这个文件夹: C:\ProgramData\Microsoft\Windows\Start Menu\Programs\Startup
 楼主| Nagisa1224 发表于 2023-11-23 18:47
binbinjimg 发表于 2023-11-23 17:02
啥错也不报,也不显示界面,这是啥问题

UmiOCR-data文件夹,运行  RUN_CLI.bat ,看看有啥问题
头像被屏蔽
rogabet 发表于 2023-11-21 12:42
提示: 作者被禁止或删除 内容自动屏蔽
1045837055lucy 发表于 2023-11-21 15:06
感谢分享,办公利器,分流阿里,以防丢失。
Umi-OCR_Paddle_v2.0.0.7z.exe
https://www.alipan.com/s/kiKwzrsUHpM
点击链接保存,或者复制本段内容,打开「阿里云盘」APP ,无需下载极速在线查看,视频原画倍速播放。
lddhnly 发表于 2023-11-21 12:12
不错,感谢分享,收藏了。
诺十年以后 发表于 2023-11-21 12:18
感谢楼主分享收藏一波
bamao666 发表于 2023-11-21 12:39
感谢楼主分享
hxd97244 发表于 2023-11-21 12:47
收藏备用,感谢升级分享。
Leo361Leo 发表于 2023-11-21 12:55
谢谢楼主分享!!
jattcn 发表于 2023-11-21 13:02
收藏备用。谢谢楼主分享!!
aqtd2 发表于 2023-11-21 13:21
感谢分享,收藏备用
您需要登录后才可以回帖 登录 | 注册[Register]

本版积分规则 提醒:禁止复制他人回复等『恶意灌水』行为,违者重罚!

快速回复 收藏帖子 返回列表 搜索

RSS订阅|小黑屋|处罚记录|联系我们|吾爱破解 - LCG - LSG ( 京ICP备16042023号 | 京公网安备 11010502030087号 )

GMT+8, 2024-5-7 18:49

Powered by Discuz!

Copyright © 2001-2020, Tencent Cloud.

快速回复 返回顶部 返回列表