2026年7月开源LLM格局剧变:GLM 5.2 首次在Agentic Coding上击败GPT-5与Claude
2026年7月注定载入开源大模型史册。30天内,10款旗舰级开源模型密集发布。智谱AI的GLM 5.2以68.5%的SWE-Bench Pro得分首次超越GPT-5和Claude,宣告开源模型在"最难Agentic Coding基准"上反超闭源前沿。
七月井喷:30天10款旗舰密集发布
过去两年,开源模型在多数基准上逐步逼近闭源,但Agentic Coding——要求模型在真实代码仓库中执行多文件、多步修改——始终是OpenAI和Anthropic最后的堡垒。七月,这道墙被推倒了:
| 模型 | 发布日期 | 参数规模 | 许可 | 核心亮点 |
|---|---|---|---|---|
| GLM 5.2 | 7月8日 | 744B-A40B MoE | MIT | SWE-Bench Pro 68.5%,首次超越GPT-5/Claude |
| GLM 5.2 Air | 7月8日 | 106B-A12B MoE | MIT | 64GB Mac可运行,SWE-Bench Pro 58% |
| Qwen 4.1 | 7月2日 | 32B-A3B MoE | Apache 2.0 | SWE-Verified 80%,24GB Mac跑62 tok/s |
| DeepSeek R3</ |


1164

被折叠的 条评论
为什么被折叠?



