# 阿里通义千问发布 Qwen3.8-Max 和 27B，下周开源模型权重

> 原标题：[AINews] Qwen 3.8 Max(2.4T) and 27B, new open weights models for Coding and Cowork

- 来源：Latent Space
- 发布时间：2026-08-04T03:49:14.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49790
- 原文：https://www.latent.space/p/ainews-qwen-38-max24t-and-27b-new

## 摘要

阿里甩出了 Qwen3.8-Max，一个 2.4 万亿参数的超大模型，主打编程和长时间自主干活。官方说它能连续 10 多天自己写代码不崩，还能在 125 小时内独立跑完一套 AI 研究流程，最后效果比原论文的基准还高了 2.71 分。在模拟一整年经营的电商测试里，它赚了 4.16 倍的回报。API 价格是输入每百万 token 2 美元，输出 6 美元...

## 推荐理由

阿里这次放出的 Qwen3.8-Max 主打长时间自主干活，给的数字挺具体——125 小时独立跑研究、10 多天连续写代码、电商模拟回报 4.16 倍。我会先打个折，因为目前只有官方博客和 Latent Space 的二手报道，没有独立复现或第三方验证，所以分数没给到 95。但 2.4T 参数这个体量加上 agent 方向的明确指标，放在本周确实值得放在头条。

## 锐评

这条消息最值得看的是它把模型能力测试从刷榜拉到了“真干活”的维度。官方说Qwen3.8-Max能自己跑完一套AI研究流程，125小时不停，最后效果比原论文基准还高了2.71分；在模拟一整年经营的电商测试里，它赚了4.16倍的回报。这些数字说明它在长时间、多步骤的自主任务上稳定性不错，但要注意，这些全是阿里自己设计的测试场景，没有第三方复现，也没给常规学术基准分，所以横向对比暂时无从谈起。API价格是输入每百万token 2美元，输出6美元，不算便宜。另外，虽然说了会开源权重，但具体哪天放、用什么许可证，正文都没写，这点先别太激动。整体看，模型在“让AI进业务流程干活”这个方向上迈了一步，但验证还缺独立评测和更透明的开源承诺。
