LynLiCoder/scan-corrector

LynLiCoder★ 0Python最后同步: 2026-08-17

在 GitHub 打开

6 种检测方法融合决策(Tesseract OSD + 霍夫变换 + 四向试探 + 文字密度 + 区域 OSD + 多区域放大重检),自动检测并修正 PDF 页面方向(0°/90°/180°/270°)。100% 本地处理,零数据上传,生成可解释的 JSON 修正报告。

README 摘要

扫描件智能纠偏工具 自动检测 PDF 中方向错误(颠倒/旋转)的页面,并一键批量旋转修正。完全本地处理,无需联网,文件不离开你的电脑。 当前版本定位:这是一个可发布的“经典引擎版”扫描件纠偏工具。它优先保证离线、本地、可解释和保守决策;现代轻量方向分类模型(PaddleOCR / ONNX)适合作为后续可选引擎增强,而不是当前版本的必要前置条件。 功能特性 - 智能方向检测 — 6 种检测方法融合决策:Tesseract OSD(8 预处理变体)、霍夫变换、四向试探法、文字密度比对、区域 OSD、多区域放大重检 - 批量处理 — 一键修正整个 PDF,多线程并行检测 - 横竖版混排 — 智能识别横版、竖版页面,逐页独立判定 - 手动修正 — 自动检测遗漏时可手动指定页面旋转角度 - 处理报告 — 生成 JSON + Excel 双格式详细报告 - 100% 本地 — 所有处理在本地完成,零数据上传 效果展示 软件操作示意 扫描件处理前后对比 手动修正界面 适合谁使用 - 隐私敏感文件 :合同、档案、试卷、内部资料等不适合上传云端的 PDF - 批量纠偏工作流 :需要逐页检测、批量旋转、生成报告,而不只是判断单张图片方向 - 需要可解释结果 :报告中保留 method 与置信度,便于定位疑难页 - 需要人工兜底 :自动检测不确定时,可通过 CLI/GUI 手动指定页码旋转 如果只追求单张图像方向分类的极限准确率,轻量 CNN/ONNX 模型通常更有优势;本项目的优势在于完整 PDF 工作流、离线部署、可解释报告和保守纠错策略。 快速开始 安装 需要 Python 3.10 或更高版本。 从源码安装时的系统依赖 如果通过 pip install . 从源码安装,需要系统安装 Tesseract OCR(方向检测引擎)。 Windows : 下载安装 ,安装时勾选 OSD 方向检测数据。 macOS : Linux (Ubuntu/Debian) : 一站式便携版用户无需安装 Tesseract :便携发布包内置了完整的 OCR 引擎和方向检测模型(位于 EXE 同级的 tesseract\ 文件夹中),解压即用。 运行 GUI 模式 : CLI 模式 : 技术架构 检测决策树 项目结构 技术栈 依赖 用途 PyMuPDF (fitz) PDF 渲染与 /Rotate 元数据写入 pytesseract OSD 方向检测 Tesseract OCR 5.x 底层 OSD 引擎(需 osd.traineddata) OpenCV 图像预处理 + 霍夫变换 NumPy 投影分析 + 数学计算 Pillow 图像格式桥接 openpyxl Excel 报告生成 检测方法说明 方法标识 含义 tesseract high Tesseract 高置信度( =20%)直接信任…

在 GitHub 查看完整 README →
工具/开发dsh-pluginocr

分类