Cerebras 上线 Qwen 3.8 27B,推理速度 1500 tokens/s
Qwen 3.8 27B available on Cerebras at 1500 tokens/s
Cerebras 在它的公开推理接口里加上了 Qwen 3.8 27B,跑到了大约 1500 tokens/s。免费用户能用 64k 上下文,付费用户能到 128k。作为对比,他们另一款模型 OpenAI GPT OSS 120B 能跑到 3000 tokens/s。这个速度确实快,但正文没披露 Qwen 3.8 27B 的具体定价和延迟,只说了有按量...