AREX Feed Article
唐杰给 GLM-6.0 定名「自进化」:完全自训练,伦理治理纳入模型研究
8 月 31 日晚,在智谱(02513.HK)2026 年半年度业绩电话会上,创始人、清华大学教授唐杰给下一代基座模型正式定名:GLM-6.0。引述唐杰的原话:「我们将未来的 GLM-6.0 版本定义为『自进化』,模型需要具备自主判断能力,能够识别何时该停止、何时该自我纠正。」他还表示,伦理与社会治理将纳入后续模型研究。
同一场发布会上,智谱披露 2026 年上半年业绩:营业收入 9.54 亿元,同比增长 399.7%,超过 2025 年全年;归母净亏损 20.71 亿元,同比收窄 12.1%(转引半年报数据)。其中 MaaS(模型即服务)开放平台及 API(应用程序编程接口)业务收入 8.25 亿元,同比增长 2,736%,占总收入 86.5%,开放平台及 API 毛利率升至 24.6%;截至 8 月末 MaaS 用户超 740 万、覆盖 233 个国家和地区,单位词元推理成本较年初下降 80%。
名字和定义一起落地:GLM-6.0 定位「完全自训练」
IT之家转引科创板日报的报道显示,智谱对下一代模型的口径是采用大基座路线、暂不披露具体参数,后续围绕基座开展中训练、后训练;的电话会报道里,下一代模型的表述是「下一代基座模型训练已正式启动」。两篇报道都没有出现 GLM-6.0 的名字。唐杰的完整定义,由当晚 21:41 的报道给出:GLM-6.0 定位 Full Self-Training(完全自训练),海外相关概念也称 RSI(递归自我改进);核心特征是模型具备「自净化」能力,覆盖从预训练、中期训练到后训练的完整流程,实现完全自主训练与自我进化。的报道进一步解释,下一代模型的重点,从继续扩大参数规模、增加训练数据、堆叠算力,转向让模型逐步具备「自己训练自己」的能力。
最大挑战:模型自己决定何时停止、何时纠错
观点网记录唐杰的判断:「全自训练范式的最大挑战并非单纯扩大模型规模,而是模型能否实现自我判断——自主把控训练停止时机、自主完成错误修正。」
传统的大模型训练流程,大体是人类设计训练方案、准备数据、进行训练、评估结果,再由工程师决定下一步怎么调整。Full Self-Training 试图改变的正是这个循环:让 AI 自己产生数据、自己验证、自己发现错误,再把结果用于下一轮训练。唐杰解释了为什么走这条路:评价模型不能只看参数量,在国内大模型训练数据已经达到数十万亿 Token(词元)的情况下,单纯扩大参数规模的边际收益正在下降。
七月的《巨浪已来》内部信,已把这条路列为核心方向
今年 7 月,唐杰在内部信《巨浪已来》中提出智谱未来两年的「摸高计划」,其中已将 Fully Self Training(完全自我训练)列为核心方向之一:建设高质量合成数据工厂,通过 AI 与 AI 之间的 Self-Play(自博弈)产生新的训练数据,并探索让 AI 在安全环境中重构自身代码,使模型迭代逐渐减少对人工工程师的依赖。
澎湃新闻的记录与之衔接:智谱董事长刘德兵提出的四大战略方向中,包括「实现 Fully Self Training(完全自训练)」,推动训练系统的递归式自我改进:数据层面通过模型对弈生成合成数据,突破人类标注上限;环境层面由智能体自动生成与验证任务环境;基础设施层面由模型自主优化推理系统,「最终形成模型参与自身改进的闭环,实现自进化」。
伦理与社会治理被纳入模型研究
证券日报网引述唐杰的原话:「在后续的研发过程中,伦理维度和社会治理因素也将被纳入模型设计的整体考量,确保技术发展与社会责任同步推进。」观点网与 ZAKER 的报道都记录了这一表态。
这与管理层在电话会上的整体表述一致。澎湃新闻报道称,刘德兵提出的四大战略方向中包括「能力与治理同步升级」:模型能力越强,越需要外部独立评估,通过权限控制、过程监督、第三方风险评估、漏洞披露等机制,实现高敏感能力的受控开放。
「都能自训练了」:X 上的传播与官方口径的边界
GLM-6.0 的定位发布后,在 X(推特)上很快被转开。AI 工程师(24.4 万粉丝)转述观点网的报道,配了一句「GLM 6 这么牛的吗?都能自训练了」,帖子获 259 赞、5.37 万次浏览。YouTube 72 万订阅的科技账号则发帖称,智谱财报发布后最值得关注的信息是「已经在研发下一代 GLM 6,具备 Full Self-Training」,获 470 赞。
后一种说法超出了官方口径:智谱此次公开的是技术定位和研发方向,GLM-6.0 仍处研发阶段,「具备完全自训练」把定位写成了既成事实。财报发布当日,智谱港股收涨 9.63%,报 1,195 港元。
参数、架构、Benchmark、时间表:一个都还没公布
对 GLM-6.0,智谱给出的只有方向和定义:没有参数规模、具体架构、Benchmark 成绩、正式发布日期,也没有模型权重。已披露的具体进展在推理侧:IT之家转引科创板日报的报道称,智谱已针对下一代模型开展推理侧预研,目标是「发布首日即可支持满规模业务调用」,避免「模型规模大但难以实际应用」。唐杰在电话会上也说,下一代模型将同步优化推理架构,用更小的激活参数实现更深的推理,「有信心推出第一天就能让大家满量用上,不会做一个大而无用的模型」。
「自进化」能否成立,要等 GLM-6.0 交付后才能检验。届时才能知道,模型是否真能像唐杰描述的那样,自主决定训练停止时机、自主完成纠错。
参考链接
- 证券日报网:《智谱上半年收入超去年全年 MaaS 平台词元调用量较年初增超 40 倍》,
- 观点网:《智谱创始人唐杰:GLM-6.0 定位全自训练技术路线》,
- ZAKER(AI 先锋官):《唐杰称智谱 GLM-6.0 将「完全自训练」》,
- 澎湃新闻:《智谱上半年营收增近四倍,称已实现 10 万卡级国产芯片规模化低成本推理》,
- IT之家:《智谱披露下一代大模型规划:采用大基座路线,目标发布首日即可支持满规模业务调用》,
- 宝玉 X 帖子:
- AI Search X 帖子: