ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

免费离线OCR软件 Umi-OCR 上手指南:截图、PDF、二维码一个下午全搞定

免费离线OCR软件 Umi-OCR 上手指南:截图、PDF、二维码一个下午全搞定 免费离线OCR软件 Umi-OCR 上手指南截图、PDF、二维码一个下午全搞定【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR你有没有遇到过这样的时刻网页弹窗里的文字怎么都选不中只能对着屏幕一个字一个字敲老板甩来一份扫描版 PDF想复制一句报价却提示此文档不可复制手里攒了上百张票据截图下班前要全部整理成文字。这些看得见却摸不着的文字正是 Umi-OCR 这款开源、免费且完全离线的 OCR 文字识别软件最擅长解决的。它把截图识别、批量图片处理、PDF 文档转文本和二维码扫描生成打包进一个绿色程序里解压即用、无需联网堪称文字提取领域的瑞士军刀。这些复制不动的瞬间你一定经历过在正式介绍之前不妨先对号入座看看下面这些场景是否熟悉网课、直播、弹窗里的文字无法选中截图后只能靠肉眼和输入法人肉搬运会议白板、PPT、纸质文档拍照后想转成能编辑的 Word却找不到趁手的工具收到的扫描版 PDF 是图片书不能搜索、不能复制、不能引用一次要处理几十上百张截图或票据一张张打开识别软件效率低到怀疑人生想给公众号配个二维码要么开在线网站要么装体积庞大的绘图软件。这些问题看似五花八门本质只有一个图片里的文字没有被解放出来。而 Umi-OCR 恰好把这条解放之路铺得又短又平。接下来我们以一位普通用户的一天为主线看看这款离线 OCR 软件是如何把琐碎的文字苦力变成几分钟的顺手操作。上午 9:00把一堆死PDF变成能搜能复制的活文本30 秒完成部署绿色免安装解压即用Umi-OCR 最大的诚意在于零门槛起步。它不需要安装向导不需要配置环境变量更不需要注册账号。从项目仓库https://gitcode.com/GitHub_Trending/um/Umi-OCR拉取代码或直接下载Umi-OCR_Rapid_v2.1.5.7z压缩包解压到任意文件夹双击Umi-OCR.exeLinux 用户运行umi-ocr.sh即可看到主界面。 如果电脑上没有安装压缩软件可以改用自解压版本.7z.exe双击后会自动完成解压连解压工具都省了。扫描版 PDF从图片书到可编辑文本上午的工作从一份老合同开始——它是客户用扫描仪存成的 PDF整份文件就是几十张图片既不能搜索关键词也没法复制条款。这时打开「文档识别」标签页把 PDF 直接拖入选择输出格式后点下开始Umi-OCR 会自动分页识别把每一页的扫描文字翻译成可编辑的文本。更贴心的是它可以输出双层可搜索 PDF底层保留原始扫描图像上层叠加透明的识别文字层。这样既保留了文件的原始版式又能像普通文档一样用 CtrlF 搜索、选中和复制。对于需要归档和反复查阅的合同、论文、古籍扫描件这个功能堪称刚需。 小技巧如果文档有页眉页脚可以在识别前用「忽略区域」功能框选排除避免页码和公司名混入正文。上午 10:30一个快捷键网页上复制不了的文字秒变文本处理完合同打开网页查资料又撞上了那种看似是文字、实则复制不了的弹窗内容。别急着开输入法按一下CtrlAltZ屏幕立刻进入截图模式——框选出需要识别的区域松开鼠标文字已经出现在「截图 OCR」页面的识别栏里。识别结果默认就是干净的可编辑文本按CtrlC直接复制双击记录可以随时修改还能一键保存为 TXT、JSONL、MD 等格式。左侧的图片预览栏支持鼠标划选局部文字右侧的记录栏可以多选合并复制日常摘抄、整理笔记的效率直接翻倍。排版解析让识别结果懂规矩OCR 引擎输出的是原始文本块排列顺序不一定符合阅读习惯。Umi-OCR 内置的排版解析方案正是为此而生报纸杂志那种多栏排版选「多栏-按自然段换行」即可按阅读顺序输出解析代码截图时切到「单栏-保留缩进」能保留行首缩进和行中空格代码结构分毫不乱。 如果截屏后界面出现闪烁或按钮错位可以在「全局设置 → 界面和外观 → 渲染器」中切换渲染方案一般即可恢复正常。下午 2:00两百张图片的批量马拉松泡杯茶的功夫下午的任务量陡增两百多张发票、截图和产品图要逐张提取文字并归档。此时切到「批量 OCR」标签页把图片文件夹整个拖进左侧列表——支持 JPG、PNG、WebP、BMP、TIFF 等常见格式——确认参数后点击「开始任务」剩下的交给进度条。批量任务没有数量上限几百张图片一次处理毫无压力。识别结果可以按 TXT、CSVExcel 直接打开、MD、JSONL 多种格式批量导出方便后续整理与二次开发。更偷懒的是它支持任务完成后自动关机或待机晚上挂着跑大任务第二天早上直接收结果。忽略区域跟水印、页眉说再见批量识别的隐藏痛点在于水印和页眉页脚——这些干扰文字会混进识别结果里污染数据。Umi-OCR 的「忽略区域」功能允许你在图片上按住右键画出矩形框框住水印可能出现的位置任务执行时这些区域内的文字会被整体忽略。一次设置整批图片生效再也不用事后人工清理脏数据。 提示矩形框尽量画得大一些完整包裹水印所有可能出现的位置识别超大长图时可到「设置 → 文字识别」中调高限制图像边长的数值。傍晚 5:00扫码与生码一个标签页全搞定临下班同事发来一个包装盒上的条形码图片要解读市场部又追着要一个跳转到活动页的二维码。「二维码」标签页把这两件事都包圆了。扫码截图、粘贴或拖入本地图片自动读取其中的二维码/条形码支持一图多码生成码输入任意文本即可生成二维码图片支持 QRCode、DataMatrix、PDF417 等 19 种编码协议还能调整纠错等级。从此再也不用为了一个码专门打开在线工具把内容发到第三方平台了——尤其对于涉及隐私信息的场景本地生成显然更让人安心。第一周把软件慢慢调成你的形状用上几天后你可能会想让它更贴合自己的习惯。Umi-OCR 的「全局设置」标签页提供了足够丰富的自定义空间。界面语言第一次启动会自动跟随系统语言也可以在「语言/Language」下拉菜单中手动切换。除了简体中文还内置了英文、日文等翻译版本——它甚至自带了多语言翻译协作平台任何人都能参与完善界面翻译主题外观内置多套亮色/暗色主题还能调整界面文字大小与字体长时间盯屏幕的用户可以调出更舒适的组合快捷键截图 OCR 默认CtrlAltZ重复上次截图是CtrlAltX全部可在「快捷键」中按自己的肌肉记忆重新定义。进阶给开发者的两扇门如果你不只是普通用户而是想把它接入自己的工作流Umi-OCR 也留好了两扇门命令行调用主程序Umi-OCR.exe本身支持命令行参数umi-ocr --screenshot可以一键唤起截屏识别umi-ocr --quit可以远程关闭软件便于写脚本批量调度详见 docs/README_CLI.mdHTTP 接口软件默认在本机开启 HTTP 服务仅本地回环通信不会泄露到外网开发自定义应用时可以直接调用识别接口文档在 docs/http/README.md插件扩展OCR 引擎、语言包等都可以通过UmiOCR-data/plugins目录扩展随时切换不同引擎找到最适合自己的识别速度和精度组合。从今天开始让文字真正属于你回顾这一天早上解救了无法复制的合同上午拿下了网页弹窗里的硬骨头下午两百张图片批量归档傍晚顺手搞定了二维码——全程没有联网没有付费没有安装一堆臃肿的软件。Umi-OCR 的价值正在于此把散落在图片、截图、扫描件里的文字交还到你的指尖。无论你是被论文、票据淹没的学生党每天和合同、报表打交道的职场人还是想为工具链加入 OCR 能力的开发者都值得花三分钟下载体验。项目本身免费开源、持续更新最新特性和改进记录可以在 CHANGE_LOG.md 中随时查看。现在就去解压那个压缩包让下一次复制不动变成历史吧。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表