
Umi-OCR 快速上手完全指南免费离线 OCR 软件截图、批量与 PDF 识别一次讲清【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR合同扫描件躺在邮箱里里面的数字却无法选中修改论文截图里的代码想复用只能重新手敲一遍。Umi-OCR 是一款开源、免费、完全离线的 OCR 文字识别工具把截图、图片和 PDF 中的文字批量转为可编辑文本全程数据不出本机。先判断它适合你吗Umi-OCR 是一款解压即用、无需安装的离线文字识别OCR软件内置 RapidOCR 与 PaddleOCR 两套离线识别引擎。目标用户是需要批量转换扫描资料的办公人员、要处理纸质文献的研究者以及希望直接复用截图文字的开发者。成本方面没有任何门槛代码开源、使用免费、无注册无登录解压后即可运行。定位速览项目说明费用开源免费无订阅、无按量计费联网完全离线运行图片不上传云端系统Windows 7 x64 及以上、Linux x64部署解压.7z或自解压包即用可放U盘随身携带界面语言首次启动自动匹配系统语言支持繁中、英语、日语等多语言从 0 到第一次出结果最短路径全程无需安装四步走通拿到并解压。下载发行版压缩包解压到纯英文路径避开中文与特殊字符也可以直接git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR获取源码。启动。Windows 双击Umi-OCR.exeLinux 运行umi-ocr.sh。界面会自动切换到系统对应语言。唤起截图。进入“截图OCR”标签页按默认快捷键CtrlShiftA框选屏幕区域快捷键可在全局设置中修改。取走文字。识别完成后右侧记录栏支持鼠标划选、编辑与复制也支持在别处复制图片后直接粘贴进软件识别。从打开软件到复制出第一段文字中间只需要一次框选动作。能力一览它还能做什么主要能力汇总如下更多细节见官方文档能力支持输入输出 / 亮点截图OCR屏幕框选、粘贴图片可编辑文本历史记录支持划选合并复制批量OCRjpg / png / webp / bmp / tiff等无数量上限txt / jsonl / md / csv(Excel)四种输出任务可暂停恢复文档识别pdf, xps, epub, mobi, fb2, cbz提取文本或输出双层可搜索 PDF排版解析所有 OCR 结果多栏按自然段 / 总是换行 / 单栏保留缩进等方案二维码识别含码图片支持 QR、条形码等 19 种协议一图多码二维码生成纯文本生成二维码图片可设纠错等级等参数两点值得注意批量任务不限制文件数量几百张图可一次导入排版解析让结果直接可读而不是一堆原始文本块。真实问题怎么解决案例一一批扫描小票进一张表格输入一个装有几十张 jpg 小票的文件夹右上角带固定水印。处理拖入“批量OCR”页输出格式选 csv在“忽略区域”编辑器中画矩形框盖住水印位置提交任务。输出每张图对应一个 csv 文件用 Excel 打开即可汇总金额与日期水印文字不会混入结果。案例二PDF 扫描件变可搜索文档输入一厚册纸质扫描 PDF内部无文字层搜不到任何内容。处理打开“文档识别”页导入 PDF用忽略区域排除每页重复的页码和页眉页脚输出方式选双层 PDF。输出生成的 PDF 既能看到原扫描影像又能全文检索、划选文字归档与引用不再需要手敲。案例三截图里的代码直接粘贴进编辑器输入屏幕上一段带缩进的 Python 代码截图。处理截图识别后把排版解析方案切到“单栏-保留缩进”。输出文本保留行首空格与缩进结构粘贴到编辑器后代码不塌、不串行。避坑与排障速查表现象常见原因解决办法启动即闪退或无法运行缺少运行库、路径含中文安装 Visual C 运行库解压到纯英文路径截屏时画面闪烁、UI 错位显卡加速渲染不兼容全局设置 → “界面和外观”中切换渲染器或关闭硬件加速大图、长图识别不完整图像边长超过默认限制批量页设置 → 文字识别中调高“限制图像边长”结果混入水印、页眉文字未设置忽略区域或框画得太小用忽略区域编辑器画大一点的矩形框整个文本块被包住才会被忽略识别准确率偏低图片模糊、对比度低、语言库不匹配提高图片分辨率与对比度选择对应的语言库识别慢、内存占用高引擎与线程参数未调RapidOCR 兼容性更好PaddleOCR 速度稍快按 CPU 核心数调整线程数命令行执行无反应使用了备用启动器如RUN_GUI.bat命令行必须通过主程序Umi-OCR.exe调用并确认 HTTP 服务已开启HTTP 连续调用偶发ECONNREFUSED后端并发能力有限避免并发调用重新发起请求即可调整参数前先翻一下更新日志确认当前版本的相关行为。从个人用到团队集成个人自动化主程序本身就是命令行入口详见命令行手册例如把整个文件夹识别后写入文件umi-ocr --path D:/daily_docs -- results.txt配合--screenshot与--clip可以做到“快捷键一按识别结果自动进剪贴板”。团队接口调用全局设置中开启 HTTP 服务默认开启主机默认为仅本地软件即变成一台本地 OCR 服务提供图片识别、文档识别、二维码识别与生成的接口参考HTTP接口文档。内部文档管理系统可据此打通链路上传触发 → 调接口识别 → 文本入库 → 建立全文搜索索引。两条注意事项同一实例避免高并发调用需要局域网访问时再把主机切到“任何可用地址”。企业级延伸用定时任务做周期性归档Linux 平台还支持 Docker 部署可在服务器上以 HTTP 接口统一供多个业务系统调用。写在最后Umi-OCR 把三件事做得很扎实文字转得出、批量转得快、过程不联网。对个人它是比手动输入更快的文字提取器对团队它是一条可以接进工作流的批量识别线。建议先在日常电脑上用截图识别和批量识别跑一周熟悉后再引入命令行与 HTTP 接口对接团队流程。关键资源官方文档 README更新日志 CHANGE_LOG命令行手册HTTP接口文档解压、启动、框一次截图第一段可编辑的文字离你只差一个快捷键。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考