有人写了个编译器,把 Python 代码转成更省 token 的格式喂给模型
作者开源了一个叫 Vulpine 的编译器,能把 Python 源码转成一种专门给代码模型看的紧凑表示。在约 1.3 万个留出测试文件上,token 用量平均减少了 14%,而且 99.8% 的情况下能无损还原回原本的抽象语法树结构。代码已经挂在 GitHub 上。不过正文没披露具体测试了哪些模型、省下的 token 对生成质量有没有影响,这点先别太激动。
推荐理由:这个 Vulpine 编译器把 Python 转成模型更容易消化的表示,实测能省 14% 的 token,往返还原成功率也高。我会先打个折:帖子没披露在真实下游任务里效果如何、编译速度多快、那 0.2% 的失败案例长什么样,所以目前只能当个有潜力的早期实验看。但思路本身对压降代码 agent 的推理成本有参考价值,数字也给了,值得从业者扫一眼。