2026-06-16 zhipu
GLM-5.2 权重落地:开放阵营把前沿压成了按季度刷新的常态
智谱放出 GLM-5.2 权重,MIT 许可,1M 上下文,主打长程任务和可调思考预算。官方自报跑分把它放到了闭源旗舰一两个点的射程内。真正的信号不是又一次刷榜,而是开放权重的能力成本曲线又压低一格。但厂商自报数字要打折,1M 是否真可用、长程是否真可靠,得自己在目标任务上测。
阅读全文High-signal frontier AI context tagged with long-context.
智谱放出 GLM-5.2 权重,MIT 许可,1M 上下文,主打长程任务和可调思考预算。官方自报跑分把它放到了闭源旗舰一两个点的射程内。真正的信号不是又一次刷榜,而是开放权重的能力成本曲线又压低一格。但厂商自报数字要打折,1M 是否真可用、长程是否真可靠,得自己在目标任务上测。
阅读全文智谱发布 GLM-5.2 并宣布完全开放,时间卡在 Anthropic Fable 被叫停的同一周。真正的新闻不是参数(没公开跑分),而是定位:当闭源 API 的访问能被非技术原因随时撤销,开放权重的价值从省钱可定制升级为供给确定性。这是开放阵营当下最锋利的卖点,但权重未上线、无独立 benchmark 前,别据此切换生产负载。
阅读全文DeepSeek V4 的核心变化不是把 1M context 写进功能清单,而是让长上下文从能力展示进入成本、路由和产品默认值的重新设计。
阅读全文DeepSeek V4 同时给出开放权重和当天可用 API,真正挑战闭源前沿模型的是部署自由与低迁移成本的组合。
阅读全文MiniMax M3 的关键不是又一个 1M context,而是 MSA 试图从注意力结构上降低长上下文每 token 成本。
阅读全文M3 的真信号是 MSA 把 1M 上下文的每 token 算力压到上一代的 1/20、解码提速 15 倍。长上下文 agent 的成本曲线第一次被一家中国实验室往下按。但发布日权重并未开放,过 10 天再开源这句承诺是诚意的试金石。
阅读全文M3 的难点不是模型卡片,而是 vLLM 等 serving 生态能否及时支持 MSA 的块级稀疏注意力。
阅读全文