# 双 RTX Pro 本地跑 Qwen 和 DeepSeek，解码速度 150 tok/s

> 原标题：Upgraded my local setup with 2 rtx pros and it's amazing.

- 来源：r/LocalLLaMA
- 发布时间：2026-09-16T23:43:20.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/56960
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1widoob/upgraded_my_local_setup_with_2_rtx_pros_and_its/

## 摘要

一位开发者用两块 RTX Pro 显卡组了台本地推理机，跑 Qwen 3.8 Flash Next 和 DeepSeek V4 Flash，解码速度达到 150 tok/s，预填充 10K tok/s，还能同时处理 4 个请求。他之前用 M3 Ultra 512GB，觉得推理太慢。新机器能跑 DeepSeek 的 1M 上下文窗口，但 Qwen 的思考...
