# Qwen3.8-Flash-Next：256K 上下文，DDR4 内存 + T4 显卡跑出 16 tok/s

> 原标题：Qwen3.8-Flash-Next: 256k context, 16tok/s on DDR4 and a Tesla T4

- 来源：r/LocalLLaMA
- 发布时间：2026-09-04T08:06:30.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54753
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1w6y38l/qwen38flashnext_256k_context_16toks_on_ddr4_and_a/

## 摘要

Qwen3.8-Flash-Next 在 DDR4 内存和一张 Tesla T4 显卡上跑出了 16 tok/s 的速度，同时支持 256K 上下文。这个组合意味着长上下文模型可以在很便宜的硬件上本地跑，适合个人部署或边缘场景。不过帖子被 Reddit 屏蔽了，正文没披露架构、训练方法或发布日期，所以目前只能看个热闹，别急着下结论。
