The Decoder· Matthias Bastian·· 4 小时前AI 评分62
AI 智能体团队成本高但收益微,研究称质量提升可忽略
AI agent teams waste massive tokens for barely measurable quality gains, research finds
AI 导读
Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5 单 agent 与团队模式的性能,发现团队成本是单 agent 的 1.8x-5.1 倍,但在 4 组对比中仅 1 组(GPT-6 Sol 中等推理)有统计显著提升,得分高 7.3 分。
来源:The Decoder · the-decoder.com