Umi-OCR离线OCR怎么上手3分钟跑通批量识别免费用【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR一页扫描件敲成文字要十分钟。传到在线识别网站文件绕道别人的服务器存没删掉你说了不算。Umi-OCR 是免费开源的离线 OCR 软件识别引擎整套装在本机图片不出硬盘。截图、批量、文档识别三件事都能本地做完。Umi-OCR怎么装从下载到第一次出结果 下载去发布页拿.7z压缩包没有压缩软件就选.7z.exe自解压包。自解压双击直接铺开不用装任何依赖。解压丢进一个纯英文路径比如D:\Tools\Umi-OCR。路径带中文或空格容易出现莫名其妙的兼容问题。启动Windows 双击Umi-OCR.exeLinux 运行umi-ocr.sh。界面语言跟随系统自动切换之后可在 全局设置 → 语言/Language 手动改。出第一个结果打开截图OCR标签页按快捷键框一块有字的屏幕右侧记录栏立刻出现识别文字。引擎在本地识别不消耗任何流量。三个最常干的活 随手截屏抓文字操作开截图OCR页快捷键唤起截图框框住目标结果进右侧记录栏。产出文字可直接改错多条记录能划选后一次复制不用再跳去别的编辑器。老手技巧在别处复制了图片比如聊天窗口里的图回到这里直接粘贴也能识别省掉截图这一步。几百张图片一次拖进来操作切到批量OCR页图片直接拖进窗口。jpg、png、webp、bmp、tif 都收没有数量上限。点开始任务右侧逐张显示耗时和结果。产出跑完可导出 txt、jsonl、md、csv 四种格式csv 能用 Excel 直接打开。老手技巧任务完成可设自动关机或待机v2.1.2 起支持暂停任务软件不退出电脑休眠后回来接着跑。扫描版PDF变可搜索文档操作文件拖进文档识别页。支持 pdf、xps、epub、mobi、fb2、cbz软件先拆出原有文字没有文字层的页才交给本地引擎逐页识别。产出可选双层可搜索 PDF——外观和扫描件一样文字却可搜索、可复制v2.1.2 起还能导出单层纯文本 PDF体积更小。老手技巧识别结果按原文顺序重排多栏 PDF 选多栏-按自然段换行读起来才通顺。拿不准选哪个看这张表 ⚙️你要解决什么选哪个什么时候用论文书籍排版乱排版方案多栏-按自然段换行两栏三栏文档覆盖面最广拿不准就选它代码截图缩进被吃掉排版方案单栏-保留缩进行首缩进和行中空格都保住结果不准或报错换引擎Rapid-OCR ↔ PaddleOCR全局设置里随时切换引擎常比调参数见效快结果进表格导出 csvExcel 直接打开归档要留档双层 PDF可搜索、可划线原貌不动卡住了先对号入座 ️结果不干净多栏 PDF 读不通顺 → 排版方案没选对 → 切多栏-按自然段换行再跑一遍。长图识别缺胳膊少腿 → 像素超出引擎默认上限 → 去文字识别设置调高限制图像边长别放大原图噪声会把准确率拉下来。批量图每页都有水印 → 忽略区域没框住 → 在批量页设置里按住右键画框只框住整个文本块才会被忽略所以框要画大框完记得保存否则配置白设。显示或加载出问题截图区域闪烁、界面错位 → 显卡渲染不兼容 → 全局设置 → 界面和外观 → 渲染器换个方案或关掉硬件加速。几万文件的文件夹卡 → 加载机制旧 → v2.1.5 已优化异步加载升级后等预览加载完再操作。PDF 提取文字位置错乱 → 页面旋转没算进去 → v2.1.5 已修复升最新版即可。命令或接口没反应命令行调用无响应 → 本地 HTTP 服务没开 → 全局设置里确认已开启默认开着仅监听本机环回数据不出机器命令行要用主程序Umi-OCR.exe备用启动器可能不支持。想接进工作流 命令行入口就是主程序指令支持简写umi-ocr --screenshot --clip截屏识别结果直接进剪贴板。umi-ocr --path D:/扫描件.png --output result.txt识别本地图片结果写入 txt 文件。umi-ocr --qrcode_create 你好 D:/qrcode.png 256生成一张 256 像素的二维码图片。软件启动后本地服务还提供 OCR、文档识别、二维码三类 HTTP 接口几十行代码就能封装成上传图片→返回 JSON的小工具。完整参数见 docs/README_CLI.md接口说明见 docs/http/README.md版本变化记录在 CHANGE_LOG.md。三条线都跑在本机图片不离开电脑。免费、开源、不用注册。现在就解压一份框第一张图试试。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考