2026年6月16日,智谱AI(Z.ai/Tsinghua)发布 GLM-5.2——首个在编码基准上跨越 80 分大关的开源模型。744B 参数 MoE(40B 激活),1M token 上下文,MIT 协议完全开源。
🔥 6月16日发布
| 参数 | 值 |
|---|---|
| 总参数量 | 744B(753B 报告) |
| 激活参数 | 40B-44B(MoE 路由) |
| 架构 | MoE + DeepSeek Sparse Attention (DSA) |
| 上下文长度 | 1,000,000 tokens |
| 最大输出 | 128K tokens |
| 许可证 | MIT(无区域限制) |
| 预训练数据 | 28.5T tokens |
| 推理框架 | SGLang / vLLM / Transformers / KTransformers |
每 4 层 Transformer 共享一个轻量级索引器。第一层算出的 top-k token 选择,直接复用给后面 3 层。在 1M 上下文下,每 token FLOPs 降低 2.9 倍。
对草稿模型应用 IndexShare + KVShare,投机解码接受长度提升 20%,消除 GLM-5.1 的训练-推理不一致。
通过 reasoning_effort 参数切换:
enable_thinking=false)| 基准 | GLM-5.2 | GLM-5.1 | GPT-5.5 | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 81.0 | 62.0 | 84.0 | 85.0 |
| SWE-bench Pro | 62.1 | 58.4 | 58.6 | — |
| MCP-Atlas | 77.0 | — | 75.3 | 77.8 |
| Humanity's Last Exam (w/Tools) | 54.7 | — | 52.2 | 57.9 |
| Design Arena (ELO) | 1360 | — | — | #1(含 Fable 5) |
| 基准 | GLM-5.2 | GPT-5.5 | Claude Opus 4.8 |
|---|---|---|---|
| FrontierSWE | 74.4% | 72.6% | 75.1% |
| PostTrainBench | 34.3% | 25.0% | ~40% |
| SWE-Marathon | 13.0% | 12.0% | ~26% |
| 项目 | 价格 |
|---|---|
| 输入 | $1.40/M tokens(缓存 $0.26/M) |
| 输出 | $4.40/M tokens(GPT-5.5 的 1/6) |
| 价格助手 Lite | $12.60/月 |
| 价格助手 Pro | $50.40/月 |
| 价格助手 Max | $112.00/月 |