ocr_kb - 逐页提取 PDF 并生成 DOCXOCRPDF 处理多模态提取LaTeX 提取★ 249 · 更新于 2026-09-30使用多模态模型逐页读取 PDF,提取文本、LaTeX 公式和配图,并通过断点恢复与核查逐步生成 DOCX 文件。⚙ 视觉读取 PDF 页面⚙ 提取文本和 LaTeX⚙ 裁剪页面配图