MonkeyOCR
小参数多模态文档解析模型
文档6.7k
MonkeyOCR 是基于轻量多模态大模型的开源文档解析工具,按结构、识别、关系三步解析 PDF,可还原公式、表格与阅读顺序,输出 Markdown,支持本地 GPU 推理。
「GitHub」栏目下「文档」分类的已发布内容,按本站发布日期从新到旧排列。
3 条
小参数多模态文档解析模型
MonkeyOCR 是基于轻量多模态大模型的开源文档解析工具,按结构、识别、关系三步解析 PDF,可还原公式、表格与阅读顺序,输出 Markdown,支持本地 GPU 推理。
PDF 论文双语对照翻译库
把英文 PDF 论文解析重排后生成双语对照文档的开源翻译库,借助大模型翻译,尽量保留公式、表格等原有版式,可作 CLI 使用也能嵌入其他程序。
把电子书译成双语对照版
用大语言模型把 epub、txt、srt 等文件译成原文与译文对照版的命令行工具,支持多家模型服务商,会话上下文模式让全书译名保持一致,也提供免 API Key 的机器翻译路线。