Umi-OCR 实测跑通解压即用500页扫描PDF一次跑出可搜索文字【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR实测时长两周从解压到最后一本扫描PDF跑完处理数据量13张截图批量任务 500多页扫描PDF 每天30多次截图识别运行环境Windows 11 x64全程断网版本 v2.1.5一句话总评免费离线OCR里上手最顺的一条路Umi-OCR 是一款免费、开源的离线OCR工具识别全部在本机完成没有登录、没有上传内置中、英、日等多国语言库支持 9 种图片格式和 6 种文档格式。我用它做三件事截图抓代码、批量整理扫描照片、把旧版扫描PDF变成能搜索的文字。解压即启动三步拿到第一个识别结果从拿到包到出结果我走的路径很短下载 v2.1.5 发行包.7z 或 .7z.exe 自解压包约 100MB解压到 D 盘——产出一个免安装的文件夹双击Umi-OCR.exe启动——产出界面自动跟随系统语言标签页就绪进「截图OCR」页按快捷键框一块屏幕上的代码——产出文字出现在右侧记录栏一键复制源码全部开源见 LICENSE 与 README.md识别在本地完成、图片不离开这台机器这是它敢被拿来处理工作文档的底气。截图抓代码和文档3秒出字排版原样保留痛点抄代码、抄多栏文档顺序乱、缩进丢。我的操作进「截图OCR」页快捷键框选屏幕代码截图把「排版解析方案」设为单栏-保留缩进多栏文档换成多栏-按自然段换行。我框了一块 30 行左右的 Python 代码3 秒内出结果行首缩进和行内空格原样保留直接粘进编辑器不用重排。右侧记录栏可以划选多条记录一起复制、存成 txt。两周下来我累计截图识别 30 多次相当于随身带了一个离线转写板。13张截图一次跑完忽略水印csv直接进Excel痛点书页照片角上的水印、页脚阴影总混进文字里。我的操作批量OCR页一次拖入 13 张 jpg/png 截图——支持 jpg、png、webp、bmp、tif 等 9 种格式数量没有上限——再进「忽略区域」编辑器按住右键在可能出现水印的角上画矩形框点开始。进度条走完13 张图逐张出结果每张都标了耗时和置信度。产出结果可存txt、jsonl、md、csvExcel四种格式。我导了 csvExcel 直接打开省掉一次手工录入。注意忽略区域按整块文本跳过矩形要完整包住水印的位置才生效框小了等于没画。500页扫描PDF变可搜索痛点那本旧PDF没有文字层翻页等于翻照片搜一个词都搜不到。我的操作文档识别页拖入这本 500 多页的扫描PDF——支持 pdf、xps、epub、mobi、fb2、cbz 共 6 种格式——在每页都出现的页眉页脚处画好忽略框输出选「双层可搜索PDF」再勾上任务完成后的自动关机。结果原图在底层保持原书排版透明文字浮在上层。翻页像原书把一个术语丢进搜索框几秒内相关段落全部跳出来。大文件可以排队处理睡前挂上早上收结果。短板与坑位先说它明确不擅长的潦草手写体和低清老照片识别率比云端在线方案低得多——我测的素材以打印体和清晰截图为主这个取舍可接受极限精度需求只能找云端方案。平台也是硬边界只支持 Windows 7 x64 和 Linux x64Mac 用户没有对应版本。我实际踩到的坑长截图丢字超长图后半段文字消失——默认的图像边长保护截断了过长的图——去页面设置把「限制图像边长」调高重跑即可水印混入正文识别结果混进水印、时间戳——忽略区域没包住整个文本块——把矩形重画大完整包裹水印位置才生效界面语言不合首次打开跟随系统语言外语界面读不懂——全局设置 →语言/Language手动切换内置简中、繁中、英、日、俄、葡等语言手写体识别差手写字识别率明显跳水——这是离线引擎的固有代价没有哪个设置能解决只能靠改善素材清晰度用之前要有预期命令行与HTTP接口我拿它批量跑过一个文件夹umi-ocr --path D:/imgs整个文件夹的图片一次识别完。更完整的参数见 docs/README_CLI.mdHTTP 接口向http://127.0.0.1:1224/argv发送 JSON 指令列表可以把 OCR 能力嵌进自己的小工具细节在 docs/http/README.md。决策清单出现这几种情况选它不亏资料不能离开本机工作文档、论文扫描件、旧书PDF要一次处理几百张图片或把扫描件变成双层可搜索PDF想要解压即用、零安装、断网照常跑打算用命令行或 HTTP 接口做自动化集成出现这几种情况建议另找方案素材以手写体、低清老照片为主追求极限识别率用的是 Mac或 Windows / Linux x64 之外的系统想要云端服务那种传完即出、按量付费的模式现在就把它解压起来拿手边一块带文字的屏幕截图框一下——能原样复制出来你就知道它值不值。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考