27
5 月
ECC 开源项目深度拆解:19 万星的 Agent 性能调校系统,给 AI 编程装上「变速箱」
如果你用过 Claude Code 或 Codex CLI 写代码,大概率遇到过这种情况:agent 为一个简单功能读了 15 个不相关的文件,调用了 8 个不需要的工具,烧掉了一大堆 token,最后代码还没写好。
ECC 要解决的就是这个问题。
ECC 是什么?
ECC 的全称很长——「The agent harness performance optimization system」(Agent 执行层性能优化系统)。简单说,它像是给 AI 编程 agent 装了一个「变速箱」和「刹车」,告诉 agent:这个场景下你只需要看这些文件、用这些工具、以这种节奏工作。
它的核心模块包括 5 个:
Skills。定义 agent 在特定场景下使用的能力清单。比如「debug 模式」下 agent 可以读日志、跑测试、查看 git diff;「refactor 模式」下 agent 可以用 replace_content...
26
5 月
Cursor Composer 2.5 实测:一个 Kimi K2.5 微调模型,凭什么在代码基准上对标 Opus 4.7——价格只要 1/60
5 月 18 日,Cursor 发了 Composer 2.5。
没有发布会,没有博客预告。一个周日下午,版本号悄悄跳了。社区开始跑分,然后数据出来了:SWE-bench Multilingual 79.8%,比 Composer 2 高了 6 个百分点。CursorBench 默认模式下 63.2%,超过 Opus 4.7 的 61.6%。但真正让开发者社区讨论的不是分数——是价格。
Standard 模式下,每任务成本 $0.07。Opus 4.7 max 是 $4.10。差了将近 60 倍。
Key Takeaways
– Composer 2.5 SWE-bench 79.8% 对标 Opus 4.7 的 80.5%,CursorBench 默认模式 63.2%...




