AREX Feed Article
GLM-5.3 day-0 上线 Fireworks 美国托管,官方称代码基准较 5.2 提升 50%
模型托管平台 Fireworks 于 UTC 时间 8 月 28 日 23:28(北京时间 8 月 29 日 7:28)在官方 X 账号宣布,GLM-5.3 已以 day-0 姿态上线其美国托管的 Serverless 平台,也就是权重开放当天即可调用。公告给出的核心数据是:较 GLM-5.2 在 Z.ai Code Bench 上提升 50%,网络安全任务达到开源权重 SOTA(state-of-the-art,当前最佳水平),并称其擅长复杂编码与长时程任务。
发布这条消息的是托管方 Fireworks,模型开发商 Z.ai 当天早些时候另有自己的权重发布。两条信息合在一起,构成了这次事件的可核实部分:模型当天开源、当天就能在美国平台按 token 付费调用。公告附带的 GLM-5.3 模型页也已同步上线,模型路径为 accounts/fireworks/models/glm-5p3。
743B 参数、104 万上下文,按 token 计费的托管细节
模型页显示,GLM-5.3 是一个 743B 参数的 MoE(混合专家)模型,上下文长度 1040k token(约 104 万),支持函数调用,不支持微调与图像输入。来源标注为 Z.ai,对应 Hugging Face 仓库 zai-org/GLM-5.3,页面创建日期为 2026 年 8 月 28 日。
托管分两种方式:Serverless API 按 token 计费,输入、缓存输入、输出分别为每百万 token 1.40、0.26、4.40 美元;On-demand 部署则独占 GPU,无速率限制。对不想自建推理栈的开发者来说,价格与调用方式就是这次 day-0 上线的直接可验证部分。
模型页还写明了一个关键机制:GLM-5.3 与 GLM-5.2 共用同一个基础模型,"每一个增益都来自后训练(post-training)",并称其在复杂编码与长时程任务上明显优于 GLM-5.2。这次升级没有换底座,全部来自训练方法的扩展。
"50%"与"开源 SOTA"都出自 Z.ai 自己的基准
公告里的两项核心数据,口径都来自模型开发商 Z.ai 自己。Fireworks 在推文中称,GLM-5.3 较 GLM-5.2 在 "Z.ai's Code Bench" 上提升 50%,网络安全任务达到开源权重 SOTA。
Z.ai 的技术博客对这两项说法有具体展开:Z.ai Code Bench 是 Z.ai 自建的私有基准,用于在贴近真实用户的场景中评估编码智能体,博客称作为私有基准,"它也降低了公开测试集污染的风险"。博客给出的具体数字是:Max 档位下 GLM-5.3 达到 34.5%(每任务约 7.5 万输出 token),GLM-5.2 为 23.4%(约 9.6 万 token);按这两个数字计算提升约 47%,与"50%"的说法接近。
网络安全部分,博客称 GLM-5.3 在漏洞发现基准 CyberGym 上得分 84.5%,高于 GLM-5.2 的 77.2%;在更深一步的 ExploitBench 上为 54.4% 对 24.4%,"翻了一倍多";在 ExploitGym 的 6 小时任务数上为 130 对 39。博客还称,团队与中国多个安全团队合作,模型在 269 个真实项目中识别出 2436 个漏洞,其中 1097 个为中高危。这些都属于 Z.ai 的单方声明,Fireworks 的公告沿用了同一口径。
权重开放 8 小时 24 分后,day-0 兑现
day-0 在这一天可以精确到小时。8 月 28 日 15:04 UTC,Z.ai 官方账号宣布 GLM-5.3 开放权重:"我们最强的智能体编码与网络防御模型,现在可以下载、运行和自定义",并附上 与技术博客链接。 这条推文的互动明显大于 Fireworks 的公告,截至 8 月 29 日凌晨核查时点赞超过 6200 次。
8 小时 24 分钟后,Fireworks 宣布 GLM-5.3 上线。Z.ai 的博客称,团队在过去一个月持续扩展后训练规模——更多环境、更多任务、更多算力,而模型在漏洞发现能力上的成长"比我们预期的更快"。
对 Fireworks 而言,这是其平台定位的一次直接兑现。该账号的自我简介是"面向大规模开源权重模型的训练与推理前沿平台",权重开放当天上架,意味着开发者不需要等待各家平台分批适配。
回复区:叫好、追问 Flash 与泼冷水并存
Fireworks 这条公告的互动量不大,截至核查时 49 次点赞、4 次转发、2283 次浏览,但回复区出现了几种不同态度。
新加坡科技分析博主 Michael Waitze 回复称网络安全表现"确实令人印象深刻",并附上了一条更深入的分析链接; 开发者 henry 只问了一句"5.3-flash 什么时候来?"; 账号安叫兽(@ajs6888)评论"5.2 还没焐热,5.3 就来了,迭代真够快的"。
持怀疑态度的 ShadowAguy 写道:"基准上提升 50%,但在真实工作流里还是找不到附件按钮。" 引用这条公告的 Jennifer's Tech World 则评价:"一个没怎么进入主流视野的模型,在代码基准上跳升 50%、网络安全开源权重 SOTA,这正是真实能力与炒作周期之间的时差。"
50% 与 SOTA:目前只有厂商口径
对开发者来说,可以立即验证的是价格与可用性:GLM-5.3 已在 Fireworks 上按每百万输入 token 1.40 美元对外提供服务。而 50% 与网络安全开源 SOTA 这两项数字,目前能追溯到的最初出处,是 Z.ai 与 Fireworks 的官方公告——前者在自己的博客里测,后者在自己的推文里引用。这也正是回复区那句"基准与现实工作流之间"的质疑所指:day-0 上架解决的是"能不能用",至于"提升多少",要等真实工作流跑过之后才有答案。