PaddlePaddle 开源 HPD-Parsing:一个 10 亿参数模型,文档解析跑到每秒 4752 个 token,比之前最快的方案还快 1.62 倍
PaddlePaddle/HPD-Parsing · Hugging Face
PaddlePaddle 在 Hugging Face 上放出了一个叫 HPD-Parsing 的文档解析模型,参数只有 10 亿,主打一个快。它的思路是把文档解析拆成两步:一个主分支负责看懂整页的排版结构,然后把各个局部区域的内容分派给多个分支同时生成,不再像传统模型那样一个字一个字地按顺序吐结果。每个分支内部还用了一种叫“渐进式多 token 预测...
推荐理由:PaddlePaddle 放出一个 10 亿参数的文档解析模型,用分层并行解码替代逐 token 生成,架构上有明显新意,直接打中本地 RAG 和文档处理从业者的需求。正文没给基准对比和具体延迟数字,所以先打 72 分。