尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

4行命令实现PDF转Markdown:Dolphin上手

发布时间:2026/9/19 10:24:59

资讯中心
01
ARTICLE

4行命令实现PDF转Markdown:Dolphin上手

4行命令实现PDF转Markdown:Dolphin上手
4行命令实现PDF转MarkdownDolphin上手【免费下载链接】DolphinThe official repo for “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.项目地址: https://gitcode.com/GitHub_Trending/dolphin33/Dolphin对着二十页的论文你只想把里面的公式和表格变成能编辑的文本不想一个字一个字复制。Dolphin 就是干这个的一个 0.3B 的多模态文档解析模型走分析-解析两阶段——先把整页按阅读顺序拆成块再并行识别每块内容最终输出一份结构完整的 Markdown。⚡ 4行命令跑通一次git clone https://gitcode.com/GitHub_Trending/dolphin33/Dolphin cd Dolphin pip install -r requirements.txt huggingface-cli download ByteDance/Dolphin-v2 --local-dir ./hf_model python demo_page.py --model_path ./hf_model --save_dir ./results --input_path ./demo/page_imgs/page_1.png第一行拉代码第二行装依赖第三行把 Dolphin-v2 预训练权重下成本地模型第四行跑仓库自带的那页数学教材示例跑完直接看结果。输入一页输出一个Markdown一次 PDF转Markdown 跑下来产物都在./results/里markdown/是同名 .md 文件output_json/是带坐标的结构化结果插图被抠出来存进figures/并在文中以相对路径引用。对应关系很直接正文变普通文本行间公式变$$LaTeX$$表格变 HTML 表格代码变代码块顺序跟原页的阅读顺序一致。公式多、代码多按内容挑参数手里是整份 PDF 或一堆扫描件--input_path直接指到 PDF 或目录多页 PDF 会逐页拆分、结果自动合并。输出想更干净加--post_process它会修公式对齐、清理识别出的重复尾巴。显存够就调大--max_batch_size同类元素批量解码元素越杂提速越明显。想单独精解某一类元素用demo_element.py配--element_type formula、table或code跳过整页布局直接识别这一块。只关心版面和阅读顺序换demo_layout.py输出每个元素的框和先后顺序。遇到问题先查这三条模型加载报错多半是权重没下全。确认--model_path指向的目录下有完整模型文件默认是./hf_model。表格转出来错位先看原图表格线清不清楚也可以改用--element_type table单独识别这块表格再对照。结果文件找不到就在--save_dir下的markdown/目录不指定时默认和输入同目录。把你自己那份 PDF 丢给demo_page.py试一次效果不满意再回头按内容类型挑参数。想看得更细翻翻 demo_page.py 的两阶段实现和 README_CN.md。【免费下载链接】DolphinThe official repo for “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.项目地址: https://gitcode.com/GitHub_Trending/dolphin33/Dolphin创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。