AREX Feed Article
Modular Cloud 上线 GLM-5.3 day-0 支持,Lattner 称内部自用
8 月 28 日 21:42(UTC), 宣布:GLM-5.3 的开源权重当天公开,Modular Cloud 已提供 day-0 支持(day zero support),并且"我们在 Modular 内部也用它"(we use it internally @ Modular)。他同时称 GLM-5.3 是 Z.ai 面向 agentic coding 最好的模型,在 Code Bench 上较 GLM-5.2 提升 50%。
这两个说法都出自 Z.ai 自己的发布口径,不是独立评测。Lattner 是 Modular 联合创始人兼 CEO,7 月 29 日 Qualcomm 完成对 Modular 的收购后,他出任 Qualcomm EVP of Advanced AI Software and Platforms, 当时写明了这一人事安排。
官方账号 9 分钟跟进,CEO 再补一句"内部自用"
15:04, 宣布"GLM-5.3 is now open-weight",称其为"面向 agentic coding 与网络防御最强的一款模型",权重上传至 Hugging Face(zai-org/GLM-5.3)。这条帖子截至抓取时有 6,258 个赞、735 次转发、约 55.6 万次浏览。
约 9 分钟后, 发布公告:"GLM-5.3 open weights are now public, and Modular Cloud has Day Zero support."(GLM-5.3 开源权重现已公开,Modular Cloud 提供 Day Zero 支持),并照引了"最擅长编码的开源权重模型、Code Bench 较 GLM-5.2 提升 50%"的表述,附了一张宣传图。同文在当天也发在 ,页面署名 "Modular, a Qualcomm company"。
Lattner 的个人账号在 21:42 再次发布,内容与官方公告基本一致,多了一句官方渠道没有的话:"we use it internally @ Modular"。帖子附了两个链接:Z.ai 官网和 Modular Cloud 控制台(console.modular.com)。
这条帖子截至抓取时有 57 个赞、4 次转发、约 5,400 次浏览。回复里有两条: 说自己"在候补名单上"(On the waitlist);常驻新加坡的科技分析师 回复称"agentic coding 的提升看起来扎实"(Agentic coding gains look solid),并附了一份各平台上线情况的梳理链接。
"50% 提升"是 Z.ai 自家基准的数字
"50% 提升"的原始出处,是 Z.ai 8 月 14 日发布的 :GLM-5.3 是"最擅长编码的开源权重模型","在我们内部的 Z.ai Code Bench 上比 GLM-5.2 提升 50%"(50% improvement over GLM-5.2 on our in-house Z.ai Code Bench)。博客同时写明,Code Bench 是 Z.ai 内部开发的私有基准,用来在贴近真实用户场景下评估编码 agent,并特意说明私有基准可以降低公开测试集污染的风险。
这个基准是私有的,题目不公开,数字无法由外部复现。博客给出的细节是:Max 推理强度下 GLM-5.3 得分 34.5%、单任务平均约 7.5 万输出 token,GLM-5.2 为 23.4%、约 9.6 万 token;High 强度下 GLM-5.3 为 31.4%、约 5 万 token,超过 Claude Opus 4.8 的 29.5%(12 万 token),但仍低于 Claude Fable 5 的 39.5%(Max 强度)。
公开基准上的数字同样来自 Z.ai 自报:Terminal Bench 3.0 从 GLM-5.2 的 4.6 涨到 28.3,DeepSWE v1.1 从 46.2 涨到 66.9,Agents' Last Exam 从 23.8 涨到 28.5。Modular 官方账号在公告里把基准写作 "Z.ai's Code Bench",Lattner 帖子里直接写 "Code Bench",两处都是转述模型方的口径。
8 月 14 日发布时就写明了:权重两周后开源
GLM-5.3 于 8 月 14 日发布,技术博客当天就预告:"两周后发布权重,待安全评估和加固完成"(We will release the weights in two weeks after launch, once safety evaluation and hardening are complete)。博客还说明,GLM-5.3 与 GLM-5.2 共用同一基础模型,所有提升都来自后训练(post-training)。
中间的节点:8 月 18 日 ,定价与 GLM-5.2 相同;8 月 27 日 ;8 月 28 日 15:04 权重如期公开。Modular 的 day-0 支持,正好踩在 Z.ai 承诺的两周"加固期"结束当天。
320B 参数、1M 上下文:Modular Cloud 上的 GLM-5.3
把 GLM-5.3 描述为"Zhipu AI(Z.ai)最新的开源权重模型,为编码、agentic 工作负载和超长周期任务而优化"。规格:总参数 320B、上下文窗口 1M token、BF16/FP8 精度;提供共享、专用、自托管三种部署方式,走 OpenAI 兼容接口(base_url 为 model.api.modular.com)。Lattner 帖末的控制台链接,即引导用户直接试用。
"day-0"是 Modular Cloud 的既定做法,,平台在 Day Zero 就同步上线 MiniMax、Black Forest Labs(FLUX)、Google(Gemma)等前沿开源模型提供商的模型,共享端点可免费体验 OpenAI 兼容接口。这次接入也有铺垫:8 月 24 日 贴出 GLM-5.2 的性价比数据时就说"我们准备好了 GLM-5.3";8 月 26 日 此前代号 Ox Alpha 的模型就是 Z.ai 的 GLM-5.3-Flash(320B 总参数、18B 激活参数、1M 上下文),并预告其端点即将上线。Modular Cloud 本身是 8 月 18 日 ModCon 2026 上发布的托管推理平台,8 月 25 日官方称其(now generally available)。
一句"内部自用",帖子里没有给出细节
Lattner 的帖子没有附任何评测报告或使用数据,两个链接分别是 Z.ai 官网和 Modular Cloud 控制台。"内部自用"目前只是他的一句话,没有场景、没有数字。"50% 提升"这一条,Z.ai 博客引用的是自家、且明确标注为私有的 Code Bench,没有附任何第三方评测。
能确认的流程是:权重公开当天,Modular Cloud 的共享端点即可调用 GLM-5.3,CEO 亲自背书。关于 GLM-5.3 是否当得起"最好的 agentic coding 模型",目前能看到的说法都回到 Z.ai 的自报基准上,而现在能自己动手验证的方式,就是在 Modular Cloud 的共享端点上跑一次。