
Umi-OCR截图、批量、PDF 三场景离线文字识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR丢进去一张会议截图十秒后得到可编辑的文本。Umi-OCR 是一款开源免费的离线 OCR 软件识别全程在本地完成不联网、不上传文件。它是什么Umi-OCR 采用 MIT 开源协议发布是一款免安装的桌面程序支持 Windows 7 x64 与 Linux x64解压即用。软件内置离线识别引擎PaddleOCR / RapidOCR 两种可切换和多国语言识别库覆盖中、英、日等常用文字。所有识别都在本机推理断网环境也能完整工作敏感文档不离开电脑。第一次打开它下载后发布包为.7z压缩包或.7z.exe自解压包直接解压没有安装步骤。装好之后Windows 下双击Umi-OCR.exeLinux 下运行umi-ocr.sh。首次启动会按系统语言自动设置界面主界面由「截图OCR」「批量OCR」「全局设置」等可自由开关的标签页组成。拿到第一份结果打开「截图OCR」标签页用快捷键唤起截图并框选区域松开鼠标后左侧显示图片与文字叠加层右侧记录区输出识别文本可直接编辑、划选和复制。能力全景功能一句话说明适用场景截图 OCR框选屏幕区域即时得到可编辑文本会议纪要、网页截图转文字批量 OCR图片不限数量排队识别结果导出为 txt、csv、jsonl、md批量图片识别、资料归档文档识别从 PDF、epub 等扫描件提取文本或生成双层可搜索 PDF扫描件电子化排版解析按栏数与段落规则重新组织文字输出顺序多栏文档、代码截图二维码识别一图多码19 种协议或由文本生成二维码图片扫码录入、批量出码忽略区域框选水印、页眉页脚将其从结果中排除带水印图片的批量处理最容易被忽略的是「忽略区域」与批量任务的组合提交任务前用矩形框住水印和页眉页脚这些文字块会整体从结果中剔除省去事后逐条清理批量任务还支持完成后自动关机或休眠适合夜间跑大批量文件。把效果调稳如果发现输入图字小、模糊导致漏字重新截图拍清楚即可识别超大图片时在页面设置中调高「限制图像边长」的数值。如果发现输出顺序错乱检查右侧设置里的排版解析方案「多栏-按自然段换行」适合大部分文档「单栏-保留缩进」适合代码截图。如果发现结果里混着水印、页眉打开忽略区域编辑器框选干扰位置框内整块文字会直接排除。接入现有工作流 最轻量的集成方式是命令行主程序本身就是指令入口指令通过本地环回传给后台进程不经过物理网卡。umi-ocr --path D:\imgs\scan --output result.txt这条命令会识别指定文件夹内所有图片含子文件夹并把结果写入文本文件。参数与更多用法见 CLI 手册。它不擅长什么只处理图片和常见文档格式pdf、epub、mobi 等不支持视频逐帧识别。扫描件严重倾斜、模糊或手写潦草时准确率会明显下降。官方仅提供 Windows 7 x64 与 Linux x64 版本没有 macOS 构建。从这里继续仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR文档入口README.md版本与变更记录CHANGE_LOG.md【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考