谢赛宁团队发布第二代表征自编码器 RAEv2,训练效率大幅提升
刚刚,谢赛宁团队放出第二代表征自编码器
谢赛宁团队、Adobe Research 和澳大利亚国立大学放出了 RAEv2。在 ImageNet-256 上训练 80 轮后,生成质量指标 gFID 做到了 1.06。更关键的是效率:衡量收敛速度的 EPFID@2 从上一代需要的 177 轮训练直接压缩到 35 轮,计算量维持在 189 GFLOPs 没涨。不过正文因为微信环境验证拦截,具体用了什...
推荐理由:谢赛宁团队放出了第二代表征自编码器 RAEv2,核心卖点是训练快了很多——原来要 177 个 epoch 才能拿到的 EPFID@2 分数,现在 35 个 epoch 就搞定,ImageNet-256 上 80 epoch 的 gFID 压到 1.06。对做图像生成的团队来说,这意味着用更少的算力、更短的等待时间就能验证想法,成本上会友好不少。不过正文没披露模型参数量和实际推理延迟,这点先别太激动,等他们把推理侧的账算清楚再看。