有人租了 21 款 GPU 跑同一个 5GB 显存的小 TTS 模型,实测速度差距
21 GPU's benchmarked running a small TTS model (vram peak: 5GB)
一位 Reddit 用户为了测 OmniVoice 这个小 TTS 模型,在 vast.ai 上租了 21 款不同的 GPU。模型跑起来显存峰值大概 5GB,不算大。测试用 xRT 作为音频生成速度的指标,每张卡都跑了 3 次带参考音频的声音克隆取平均。正文没披露具体哪张卡最快、速度差多少倍,也没给价格和性价比对比,所以只能看出有人在认真做横向实测,但...
推荐理由:一个 Reddit 用户用 vast.ai 租了 21 款 GPU,跑 OmniVoice 这个小体量 TTS 模型,峰值显存才 5GB,每次测试跑 3 遍取平均 xRT。我会先打个折:这是个人在云租用环境下的非严格基准,不是实验室受控测试,但胜在真实、直接,能帮想自己部署语音合成的人快速筛显卡。正文没披露具体 xRT 数值表,只给了结论性对比,这点先别太激动。整体信息量对本地推理圈子有用,但范围偏窄,所以放在低 featured 档。