# Qwen3.8-Flash-Next 跑在笔记本+外接显卡上，速度从22飙到84 tok/s，离双3090服务器只差一道编程题

> 原标题：Qwen3.8-Flash-Next (104 GB MoE) on a Strix Halo + RTX 3090 Ti eGPU: 22 -&gt; 84 tok/s, and within one HumanEval+ problem of a dual-3090 vLLM box at 0.4x the wall time

- 来源：r/LocalLLaMA
- 发布时间：2026-09-02T00:21:25.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54168
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1w4ur6e/qwen38flashnext_104_gb_moe_on_a_strix_halo_rtx/

## 摘要

有人在 Strix Halo 笔记本上外挂一块 RTX 3090 Ti，跑通 104GB 的 MoE 模型 Qwen3.8-Flash-Next，推理速度从纯笔记本的 22 tok/s 拉到 84 tok/s。对比双 3090 的 vLLM 服务器，HumanEval+ 编程测试只差一道题，而且总耗时只有服务器的 0.4 倍——如果是真的挺省钱。不过原...
