3
7 月
GLM-5.2 vs Claude Sonnet 5:中美AI模型编码能力实测对比
中国Z.ai的GLM-5.2在OpenRouter排名超越Anthropic模型,Code Arena前端编码排名第2,成本仅Claude的1/6。与最新发布的Claude Sonnet 5来一场编码能力正面对比。
3
7 月
Claude Code Dynamic Workflows 正式发布:Pro 用户也能调度 1000 个并行 Agent,6 天完成 96 万行代码迁移
Claude Code Dynamic Workflows 从研究预览升级为 GA。Pro 用户($20/月)终于可用,最多 1000 个并行 Agent。Bun 96万行 Zig→Rust 迁移 6 天完成,99.8% 测试通过。
3
7 月
Ponytail:7万星 GitHub 项目,用YAGNI哲学让你的AI代码减半
70,152 stars 的 Ponytail 是一个 Claude Code Skill,它用 YAGNI 极简哲学让 AI 生成代码减少 54%、token 用量减少 22%。实测成本降低 20%,安全评分 100%。
3
7 月
智谱 GLM-5.2 声称对标 Mythos:中美 AI 模型差距,正在用另一种方式缩小
智谱 GLM-5.2 声称网络安全能力对标 Mythos。7530亿参数开源模型在漏洞发现超越 Opus 4.8。点状突破策略验证出口管制下的新竞争常态。微软考虑纳入平台。
3
7 月
美团 LongCat-2.0:1.6 万亿参数编码模型,100% 国产芯片训练,全开源
美团发布 LongCat-2.0:1.6万亿参数 MoE 编码模型,5万张国产芯片全流程训练,全开源。不到一年参数规模从5600亿翻三倍。全栈自主训练可行性获验证。




