ByteShape 发布 Qwen 3.8 27B 完整 ShapeLearn 量化版,13.1 GB 显存跑出 99.63% 精度
Shapelearn Qwen 3.8 27B (13.1 GB VRAM)
ByteShape 放出了 Qwen 3.8 27B 的完整 ShapeLearn 量化模型,一共五个版本,覆盖不同显存和速度。默认推荐 GPU-5(IQ4_XS,3.84 bpw,13.1 GB),在 RTX 5090 上跑出 93.66 tok/s,精度达到 BF16 的 99.63%。如果显存紧张,GPU-4(IQ3_S,11.0 GB)也能保住...