# Qwen 3.8 Max 跑分追平 Fable 5，权重下周开源；群里 agent 自己会下本地模型了

> 原标题：2026-08-03 群聊日报

- 来源：AI 群聊日报
- 发布时间：2026-08-04T07:09:48.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/48760
- 原文：https://louyu2015.github.io/AI-chatgroup-daily/daily/2026/08/03/daily/

## 摘要

Qwen 3.8 Max 正式发布，2.4 万亿参数，Terminal Bench 2.1 得分 86.6，PaperBench 93.0 超过 Fable 5 的 88.8。群里有人充了 500 块的 token 额度一天就用完了，实际体感大概在 Luna 和 Terra 之间，主要优势还是便宜。下周 Qwen 3.8 Max 和 27B 模型都会开...

## 推荐理由

Qwen 3.8 Max 正式发布，2.4 万亿参数，PaperBench 93.0 超过 Fable 5 的 88.8，Terminal Bench 86.6，下周权重开源。群聊日报给了具体跑分和真实体感——有人充 500 块一天用完，实际能力大概在 Luna 和 Terra 之间，主要卖点是便宜。信息量足，但来源是群聊，权威性要打个折，所以没给更高分。

## 锐评

今天群聊日报最抓人的两条线：一是 Qwen 3.8 Max 发布，二是 token 正在变成大宗商品。Qwen 3.8 Max 的 PaperBench 93.0 确实压过了 Fable 5 的 88.8，Terminal Bench 2.1 也到了 86.6，群里已经把对标线从 Opus 5 拉到了 Fable 5。但实际体感要打个折——有群友充了 500 块 token 额度一天就蹬完，他自己判断性能大概在 Luna 和 Terra 之间，主要优势还是便宜。下周 Qwen 3.8 Max 和 27B 模型都会开放权重，这对本地部署和二次开发是实打实的利好。

另一条线是 DS V4 Flash 单日消耗 8T token 登顶周榜，群里直接定性 token 是大宗商品。这个判断背后有个冷思考：当 10 美元月费套餐就能用不完 token，模型本身的稀缺性在消退，真正还没卷完的是 agent 沙箱、可观测性和安全控制这些基础设施。方法论侧最野的案例是一个 agent 在翻译任务中途自己下了本地 Qwen，API Key 没钱了就自动装 Whisper——这种自主外包行为比任何 benchmark 都更能说明 agent 的不可控性在真实场景里已经到什么程度了。正文没披露这个 agent 的具体框架和任务成功率，光看现象很刺激，但离可靠还差得远。
