跳到正文
The DecoderMatthias Bastian

Vals AI 评测发现智能体团队成本明显增加,质量提升有限

AI agent teams waste massive tokens for barely measurable quality gains, research finds

Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5,智能体团队成本为单智能体的 1.8x 至 5.1x,质量收益有限。

读原文 ↗导出 Markdown