跳到正文
原文
The Decoder· Matthias Bastian·· 3 小时前AI 评分62

研究称多 agent 团队消耗大量 token 但几乎不提升质量

AI agent teams waste massive tokens for barely measurable quality gains, research finds

AI 导读

Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5 的单 agent 与多 agent 表现,发现团队配置比单 agent 多花 1.8x 到 5.1x token,但四项对比中只有 GPT-6 Sol 中等推理下的团队得分显著高出 7.3 分,最大推理下没有优势。

来源:The Decoder · the-decoder.com