AI agent teams waste massive tokens for barely measurable quality gains, research finds
Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5,智能体团队成本为单智能体的 1.8x 至 5.1x,质量收益有限。
Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5,智能体团队成本为单智能体的 1.8x 至 5.1x,质量收益有限。