跳到正文
Hacker News 首页

本地 Qwen 不是缩水版 Opus,它是另一种工具

Local Qwen isn't a worse Opus, it's a different tool

Alex Ellis 用一块 RTX 6000 Pro 跑本地模型,两三个月就回本了。Qwen 27B 在 SWE-Bench 上只比 Claude Opus 4.8 低 12%,但一到他写的 Go 分布式系统里,量化后的模型就会陷入死循环和幻觉——他仍然不敢让它无人值守干活。正文没披露 token 速度和延迟数据。

推荐理由:Alex Ellis 拿自己公司的代码库做了次真实对比,不是跑分党自嗨。Qwen 27B 在 SWE-Bench 上只比 Opus 4.8 低 12%,看着差距不大,但一进他的 Go 分布式系统就翻车——量化后死循环、幻觉,他仍然不敢让模型无人值守干活。我会先打个折:正文没给 token 速度和延迟数据,结论偏个人经验,不是系统性评测。但“跑分接近不等于干活靠谱”这个判断,对正在选型的人很值钱。

读原文 ↗导出 Markdown