Vals AI 评测发现智能体团队成本明显增加,质量提升有限
AI agent teams waste massive tokens for barely measurable quality gains, research finds
Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5,智能体团队成本为单智能体的 1.8x 至 5.1x,质量收益有限。
AI agent teams waste massive tokens for barely measurable quality gains, research finds
Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5,智能体团队成本为单智能体的 1.8x 至 5.1x,质量收益有限。