# Qwen3.8 27B 在 Artificial Analysis 综合智能评测里拿了 52 分，开源模型里排第一

> 原标题：Qwen3.8 27B scores 52 on Artificial Analysis

- 来源：Hacker News 首页
- 发布时间：2026-08-17T17:25:17.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/51257
- 原文：https://artificialanalysis.ai/models/qwen3-8-27b

## 摘要

阿里巴巴 2026 年 8 月放出的 Qwen3.8 27B，在 Artificial Analysis 的智能指数上得分 52，压过了另外 134 个模型，是目前开源权重模型里最高的。这个指数综合了 9 项考试，覆盖让模型干业务流程的智能体任务、写代码、科学推理和知识问答。模型话特别多，跑评测时吐了 1.6 亿个 token，差不多是其他模型中位数的...

## 推荐理由

Qwen3.8 27B 在 Artificial Analysis 的智能指数上拿了 52 分，是目前开源权重模型里最高的，压过 134 个模型。数据给得实在，有分数、有 token 量对比，也把话多导致推理成本高的问题讲清楚了，三个维度都踩中。没给更高分是因为这是第三方跑分，不是自家放出的新能力或开源动作。

## 锐评

阿里新放出的 Qwen3.8 27B 在 Artificial Analysis 的智能指数上拿了 52 分，是目前开源权重模型里最高的。这个指数综合了 9 项考试，包括让模型在终端里干活、写代码、科学推理和知识问答，覆盖面比单一跑分要实在一些。

不过有个细节得注意：这模型话特别多，跑完评测总共吐了 1.6 亿个 token，是其他模型中位数的近 4 倍。话多不一定代表能力强，也可能是在凑字数，评测方没说明是否对啰嗦输出做了惩罚。另外 API 价格显示 $0，正文没解释是免费试用还是数据缺失，这点先别太激动。

模型权重放在 Hugging Face 上，用 Apache 2.0 协议，支持图文输入和 256k 上下文窗口。目前缺的是实际业务场景的延迟数据和不同 API 提供商的横向对比，光看评测分数还判断不了落地成本。
