AREX Feed Article
两路独立指纹指向智谱:Ox Alpha 疑为未发布 GLM-5.4/5.5
8 月 21 日,OpenRouter 匿名模型 stealth/ox-alpha 的身份悬疑在一天内出现三组新进展:德国 AI 分析师 Chubby 基于 tokenizer 推断它最可能是智谱尚未发布的 GLM-5.4/5.5;X 用户 KC 与俊哥 Felix 分别用文本 token 差分和视频 token 开销两路独立方法,把指纹指向智谱 GLM 系;OpenCode 官方宣布该模型上线 OpenCode Go,未来 6 天免费。
这些判断全部来自社区与分析师个人,智谱官方没有确认,模型真实开发者仍未公布。
ox-alpha 是 OpenRouter 于 8 月 20 日上架的"隐身模型"(stealth model):由匿名第三方提供商 Stealth 运营,免费提供 1,048,576 token(1M)上下文、最大输出 131,072 token,支持文本、图像与视频输入,OpenRouter 在声明自己不是该模型的开发者、所有者或提供商。此前社区已有文本 tokenizer 层面的猜测指向智谱,本轮的进展,是把单一猜测变成了两路互相独立的技术验证。
80 token 隐藏提示词,和一个关不掉的侧信道
KC(@ScarletKc_)在里先讲了直接探测的失败:ox-alpha 被注入一段约 80 token 的隐藏系统提示词,只会自称"由一家未公开组织开发",但它的 reasoning 输出直接泄了底——"According to my system prompt, I should identify myself as ox-alpha, developed by an undisclosed organization"(按照我的系统提示词,我应该自称 ox-alpha,由一家未公开的组织开发)。
常规探测也全被防住:GLM 模板的特殊 token 和 /nothink 开关被服务端过滤,logprobs 不开放,传 reasoning 参数直接返回 400。他的判断是:"对方显然知道会有人来扒。"
但 tokenizer 藏不住。方法是对同一模型发两次请求,一次用户消息为 X,一次为 X 加一段后缀,两次 prompt_tokens 的差值就是后缀在该模型词表下的 token 数,隐藏系统提示词在差分中恰好被抵消。他选了四段刁钻文本当后缀:生僻字、超长英文单词、中英数字混排、日韩混合,对照组是各家 2026 年 8 月的最新模型。
- ox-alpha:24/11/32/23
- GLM-5.3 与 GLM-5.2 官方端点:24/11/32/23,完全一致(KC 称这套词表从 GLM-4.5 起没换过)
- Qwen3.8-Max:24/11/34/14
- DeepSeek-V4-Pro:24/11/28/20
- Kimi K3:17/7/24/57
KC 解释,生僻字那段各家如今都走 byte 回退,前两个数字已区分不了国产模型,但后两段只有 GLM 能对上:"四个数字全同的只有 GLM 一家。词表是模型改不掉的指纹。"知识画像也对得上:它记得 GLM-4.5 是 355B 总参、32B 激活的 MoE、混合推理、2025 年 7 月发布,知识截止在 2025 年底附近,知道 DeepSeek V3.2,对 2026 年的事一片空白,"连 GLM-5 都没听说过,但对智谱自家资料就是格外熟"。
GLM-5.3 于 8 月 18 日刚发布,他的结论是:"这个大概率是下一个还没发布的版本在盲测。"
四段视频:ox-alpha 与 GLM-5V-Turbo 逐条一致
约六分钟后,俊哥 Felix(@LiFeng61532)用视频模态做了独立验证。开头就是"有极大证据表明这会是 GLM":在四段可控测试视频上,ox-alpha 与 GLM-5V-Turbo 的 token 开销逐条完全一致,同时命中三个相互独立的编码器设计选择:与帧率无关的抽帧策略、约 147 token/秒的时长缩放、逐帧的分辨率缩放。
上方配图里的数字对应他的结论:2 秒/30fps/360p 和 2 秒/5fps/360p 两段,ox-alpha 与 GLM-5V-Turbo 同为 296 token,GLM-4.6V 为 1,832、Qwen 3.8 Max 为 408、MiMo v2.5 为 910;6 秒/30fps/360p 段同为 884;2 秒/30fps/720p 段同为 1,064。帧率变了 token 数不变,时长从 2 秒拉到 6 秒开销从 296 涨到 884,正好落在约 147 token/秒的线性缩放上,升到 720p 才显著放大。其余被测候选模型(MiMo v2.5、Qwen 3.8 Max、GLM-4.6V)的签名都有明显差异。
同款 tokenizer 把猜测推到 GLM-5.4/5.5
把猜测具体到版本号的分析来自德国 AI 分析师 Chubby(@kimmonismus,GetSuperintel 主编)。他的发布于当天上午 8 点 52 分(UTC),早于两份技术验证:"如果这真的是 GLM-5.4/5.5,那将改变一切,毫不夸张。"
他的推理是:既然 tokenizer 相同,最可能的就是 GLM。时间线论据是,GLM-5.3 约一周前刚发布,相比 GLM-5.2 是一次极其显著的跃升,而改进只来自同一基座上的 RL 后训练;如果一周之后 GLM-5.4 又强出一截,那将说明:模型迭代在加速而非放缓,"现在比以往任何时候都更接近指数增长"。
这会迫使 OpenAI 和 Anthropic 加快发布,尤其 Anthropic 面临即将到来的 IPO,"现在必须证明自己",也会给"为了安全而放慢"的主张施加压力;中美之间的差距会进一步、更快地缩小。他提到"大家普遍认为这是个中国模型,没人怀疑是 Google 的模型",同时列出两个备选假设:MiMo,或"相当牵强"的 Ilya Sutskever 的 SSI 模型。他引用 @davis7 用 Fable 做的相似性测试并附上截图,说自己"很少见到社区同时如此印象深刻又如此困惑"。截至核实,这条推文获得约 732 赞、7.9 万次浏览。
OpenCode Go 免费接入,身份仍未公布
同日上午 11 点 11 分(UTC),OpenCode 官方账号(企业认证,15.4 万粉丝):Ox Alpha 现已上线 OpenCode Go,"未来 6 天,用量近乎不限、完全免费,不计入 Go 套餐用量"。Ox Alpha 的分发面由此从 OpenRouter API 扩展到 OpenCode Go。截至核实,这条推文获得约 1,394 赞、5.9 万次浏览。
OpenRouter 的模型页仍把提供方标为匿名的 Stealth,提示词与补全由提供商保留、不用于训练,OpenRouter 只负责转发请求。页面活动数据显示,这个上线仅一天的免费模型已被大量调用:Claude Code 累计 54.6B tokens、Hermes Agent 47.4B、ZCode 26.8B,近 3 日可用率 98.83%。
身份问题依然悬着:模型页没有开发者信息,OpenCode 的公告也没有点名厂商,三份社区分析都以"如果属实"或"大概率"为前提。KC 在推文末尾给这条线索一个技术上的收束:想匿名的话,光注入系统提示词、过滤特殊 token 是不够的,"只要 API 还返回 prompt_tokens,这条侧信道就一直开着"。在智谱官方确认或否认之前,模型页上的提供方仍是匿名的 Stealth。
参考链接
- _