首页/新闻资讯/正文详情

Umi-OCR 离线OCR实战指南:截图、批量、PDF识别三件事一次搞定

发布时间:2026/9/24 16:46:11 来源:云帆数科 栏目:资讯中心
Umi-OCR 离线OCR实战指南:截图、批量、PDF识别三件事一次搞定
Umi-OCR 离线OCR实战指南截图、批量、PDF识别三件事一次搞定【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源的离线OCR软件截图取字、批量图片识别、PDF 扫描件转可搜索文本全在本地完成不联网、图片不上传。这篇带你从解压到跑通三个最常用的任务再告诉你怎么用命令行或 HTTP 接口把它接进自动化。 第一次跑通解压、启动、截个图试试发布包是.7z压缩包也有.7z.exe自解压版Windows 7 x64 和 Linux x64 都支持无需安装、无需注册Windows 找到Umi-OCR.exe双击Linux 环境跑umi-ocr.sh首次打开界面语言跟随系统设置想换语言去全局设置 → 语言繁中、英文、日文都能切打开截图OCR标签页按截图快捷键框选屏幕区域Esc取消文字自动落到右侧记录面板划选即可复制主界面左侧预览可划选文字右侧记录按时间保存每次识别结果同一套界面还能并排显示多语言切换不重学 三个高频任务代码截图带缩进直接贴进IDE谁会遇到文档、视频里看到一段代码想贴进 IDE 复现手敲又慢普通截图OCR还会把缩进吞掉。截图OCR页框选代码区域右侧设置里把排版解析换成单栏-保留缩进识别完直接从记录里复制OCR 引擎只负责认字排版解析负责按阅读顺序把文字块拼回去这个方案就是为代码设计的行首缩进、行中空格全保留。合格线贴进 IDE 后缩进层级与原图一致、没有多余空格。一文件夹扫描图批量转成txt和Excel谁会遇到手里一批扫描文档、票据、拍照图片一张张识别不现实。批量OCR页选图片或直接拖入文件夹没有数量上限输入支持jpg / jpeg / jfif / png / webp / bmp / tif / tiff输出可选txt / jsonl / md / csv(Excel)点开始任务左侧列表逐张显示耗时和置信度0~1每张图都有固定位置的水印或 LOGO 时进右侧设置的忽略区域编辑器按住右键画矩形只有完全落在框内的文本块会被丢弃框画大一点更稳。合格线随机抽 3 张图对比预览与记录置信度低于 0.8 的几张重点人工核对。扫描件PDF变成能CtrlF的文档谁会遇到PDF 是纯图片扫描版全文搜索是空的想引用一句话却翻不到页。打开文档识别页拖入文档支持pdf / xps / epub / mobi / fb2 / cbz可设忽略区域排除页眉页脚只认正文任务结束得到双层可搜索PDF原图在底下、识别文字在顶上版面不丢还能搜能选合格线打开生成的 PDFCtrlF搜一个只在正文出现的词能跳到正确页即过关。 值得动手的几项设置日常基本只用这几项其余保持默认设置项什么时候调建议值调了会怎样排版解析方案代码截图单栏-保留缩进行首缩进与行中空格保留可直接粘贴排版解析方案多栏报纸、长文档多栏-按自然段换行默认方案自动理顺多栏阅读顺序限制图像边长大图、小字多2880 或 4320默认 960 会先压缩大图小字发糊调高更准语言/模型库英文文档、纯代码models/config_en.txt中文模型认纯英文可能出怪字符OCR引擎插件想换一套引擎Rapid-OCR自带兼容性好、速度够全局设置里可切换界面改动会自动存进UmiOCR-data/.settingsini 格式手动改完执行umi-ocr --reloadv2.1.5 起支持即可刷新。 接进自动化命令行与HTTP二选一前提全局设置里允许 HTTP 服务默认开启主机保持仅本地指令只走本机环回、不出网。命令行入口就是主程序umi-ocr是Umi-OCR.exe的简写umi-ocr --screenshot --clip # 截图识别结果进剪贴板 umi-ocr --path D:/docs --output 结果.txt # 整个文件夹批量识别并写文件 umi-ocr --qrcode_read D:/code.png # 读取图片里的二维码注意 shell 的重定向和|管道可能失效写文件请用--output。HTTP 这条线记住一件事就行默认端口1224先用GET http://127.0.0.1:1224/api/ocr/get_options查有哪些参数和默认值再向POST http://127.0.0.1:1224/api/ocr提交 base64 编码的图片即可取回识别文本完整参数表见 图片识别接口文档。 出问题了查这里命令行 / HTTP 没反应多半是 HTTP 服务没开。全局设置里勾选允许 HTTP 服务主机选仅本地。HTTP 偶尔报ECONNREFUSED的话重发一次请求即可。识别顺序错乱、读不通排版解析方案和图里的排版对不上。代码图换单栏-保留缩进多栏文档用多栏-按自然段换行。大图里的小字认错默认边长限制 960 会先压缩大图。把限制图像边长调到 2880 以上再看。水印、LOGO 混进结果水印里的文本块被一起认了。批量识别里画忽略区域右键画矩形把水印位置整个包住。Umi-OCR 像个放在本地的 OCR 工具箱免费、离线截图/批量/PDF 三件事一次做完还留了命令行和 HTTP 两个口子接自动化。建议先在截图页练熟再用批量页处理文件夹。延伸阅读命令行手册 · HTTP接口手册 · 图片识别接口文档【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

pip 需求文件格式(requirements.txt)完整指南:语法、选项与源码解析
pip 需求文件格式(requirements.txt)完整指南:语法、选项与源码解析

pip 需求文件格式(requirements.txt)完整指南:语法、选项与源码解析 【免费下载链接】pip The Python package installer 项目地址: https://gitcode.com/gh_mirrors/pi/pip 导读:需求文件(requirements file&a… · 2026/9/24 16:46:11

Valetudo 新人指南:本地化扫地机器人云替代方案的工作原理、能力边界与选型安装路径
Valetudo 新人指南:本地化扫地机器人云替代方案的工作原理、能力边界与选型安装路径

物联网后端前端 【免费下载链接】Valetudo Cloud replacement for vacuum robots enabling local-only operation 项目地址: https://gitcode.com/gh_mirrors/va/Valetudo 点击查看 免费下载 Valetudo 是一个面向扫地机器人的"云替代方案"(cl… · 2026/9/24 16:46:04

RenderDoc Python 脚本线程模型详解:UI 线程、Replay 线程与脚本线程的协作机制
RenderDoc Python 脚本线程模型详解:UI 线程、Replay 线程与脚本线程的协作机制

开发工具调试器图形学GPU 【免费下载链接】renderdoc RenderDoc is a stand-alone graphics debugging tool. 项目地址: https://gitcode.com/gh_mirrors/re/renderdoc 点击查看 免费下载 导读 RenderDoc 的 UI(qrenderdoc)是一个图形化调试… · 2026/9/24 16:46:04

DEIM 改进系列(九):Mamba 状态空间改进——把 neck 通路从“单点卷积“升级为“序列扫描“
DEIM 改进系列(九):Mamba 状态空间改进——把 neck 通路从“单点卷积“升级为“序列扫描“

DEIM 的 neck lateral 通路(融合前投影)原始实现是 11 卷积——逐像素独立处理,没有序列上下文;而 Mamba 这类状态空间模型用线性复杂度的序列扫描,天然具备长程上下文建模能力。针对这条"只看单点、不看邻居&quo… · 2026/9/24 17:29:00

咨询公司新产品开发指南
咨询公司新产品开发指南

本文档为《全球知名咨询公司新产品开发指南》,适配制造业(如电子、消费产品等)的产品研发部门(产品设计 / 研发管理岗)、市场部门(市场调研 / 品牌营销岗)、销售部门(销售管理 / 区域… · 2026/9/24 17:29:00

YOLO端上部署:MNN Android部署YOLOv8 YOLO11 YOLO26(含源码,支持CPU和GPU)
YOLO端上部署:MNN Android部署YOLOv8 YOLO11 YOLO26(含源码,支持CPU和GPU)

YOLO端上部署:MNN Android部署YOLOv8 YOLO11 YOLO26(含源码,支持CPU和GPU) 目录 YOLO端上部署:MNN Android部署YOLOv8 YOLO11 YOLO26(含源码,支持CPU和GPU) 1. 前言 2. 部署框架MNN 3. 导出MNN模型 4. Android端上部署模型 … · 2026/9/24 17:28:54

导师放养,机械博士论文初稿拖到Deadline还毫无头绪,怎么办?
导师放养,机械博士论文初稿拖到Deadline还毫无头绪,怎么办?

前言机械博士最焦虑的时刻,可能不是实验失败,而是论文Deadline已经摆在眼前,打开Word却不知道从哪里开始。几年时间里做了大量实验、仿真,也发表了几篇SCI,可真正面对博士毕业论文时,却发现:实验… · 2026/9/24 17:28:54

DEIM 改进系列(八):频域处理改进——给特征“换个坐标系看问题“
DEIM 改进系列(八):频域处理改进——给特征“换个坐标系看问题“

DEIM 从主干到 neck 的所有算子都在空域干活——卷积在空域滑窗、注意力在空域加权,但很多结构信息(纹理、边缘、周期性)在频域里表达得更清晰。针对"全程空域视角"这个盲区,我们做了一批频域处理替换变体,双… · 2026/9/24 17:28:54

新型智慧城市建设项目初步设计与投资概算
新型智慧城市建设项目初步设计与投资概算

本份文档为地市级别智慧城市完整初设概算实战范本,适配智慧城市项目投标、可研‑初设编制、政务数字化咨询方案撰写。文档遵循国家及地方数字政府政策标准,采用 “1234” 总体架构,覆盖基础设施、八大基础支撑平台、多类主题智慧应用&#xf… · 2026/9/24 17:28:54

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码