本帖最后由 shawky.nasr 于 2026-9-2 20:00 编辑 1 w) p9 A: _3 x M9 H
% e. B+ f% B- M: `8 `$ [# K
! Z% ~3 U( {; }% O6 Y7 J' w4 X# q) x
5 |$ z& A2 m# y/ E5 d; T; I; e6 t* h- O7 ]
5 o6 v& t2 ]. E$ g. n" j( j1 t
* |: d! k2 \9 W5 L% n
' l/ x9 r/ y" ~( @2 E, ]
& {' |, r- O: V- U5 A* ~
3 I5 [: o' b% r: t7 }% R: MOCRAIHub 是一款功能强大的多引擎桌面端 GUI 应用程序。它利用世界上最先进的视觉语言模型 (VLM),能够从图像和 PDF 中高精度地提取文本、Markdown 表格、数学公式和图表,实现完美的文档数字化。& W9 }7 w6 H/ n/ B# |
+ o0 S1 A+ ?# k; I8 ^+ h W
目前支持 Gemini (2.5/3.7) 和 百度 PaddleOCR-VL (1.6)、合合信息 TextIn (v1 xparse) 和 MinerU (vlm)。 4 d# S! e; j. x$ @/ f- G
推荐用 3.5-flash-lite 或 3.1-flash-lite,任何模型需要API Key
# X# d" L# }; m7 p4 n1 d w" V4 n
0 }. M- Q; M6 H. e核心功能
- T O! j2 P4 [4 ^- 多引擎支持: 在 Google Gemini API 和百度 AI Studio PaddleOCR 接口之间无缝切换。
$ V- ^3 Z& s5 p. M, g6 b# x# D# ^. Z - 智能 Markdown 格式化: 完美重构文档排版,包括标题、段落、复杂表格和 LaTeX 数学公式。6 [/ C& H6 s8 Q% ~0 ~/ X
- 原生 PDF 与页面切分:, t% M' u3 O1 q$ Q
- 本地模式: 使用 PyMuPDF 在本地将 PDF 转换为图像,支持高级图像预处理(Otsu 二值化 & 形态学降噪)。
, l- I+ |+ B. ]) b( O - 原生模式(百度): 将原始 PDF 文件直接发送至云端引擎进行原生解析。
J3 p/ Q H; t1 L& R - 自动下载插图: 自动检测、裁剪并下载文档中的图表、图片,保存至本地文件夹。
0 z5 o: [1 k# ^8 `3 _ - ✂️ 智能分栏切割: 智能分割多栏文档(如词典或学术论文),防止文本混版。3 s( T. |+ l2 @$ b. s9 B7 \* P
- 自动保存与批量处理: 自动处理包含上百张图片的文件夹或超大 PDF 书籍,内置 API 频率限制处理机制,并自动保存为 .md 或 .csv 格式。$ s" H; r' y& Q7 `& k/ A; `. N
0 @' H! U7 c8 ]8 x% N& R1 o6 F; s& e6 Y! t! I0 F; N
下载:官方项目! ?% }* N1 u6 [( v' F8 Q
9 R$ R7 \, q. A百度云盘 : 5 J: d3 H0 `8 y$ _ w
" c' i! e" Z! D8 Y# S
& f" d& R: e5 G3 V$ g z1 S I& h: T5 w9 m' ?: E
特别鸣谢 klwo2 大,自 2 月份起持续协助在 Windows 环境下进行深度测试与 Bug 排查,为软件的跨平台稳定性做出了重要贡献!
& o5 w1 q/ H$ B
# Y4 ]/ L1 s# ]& E) } |