News
智谱唐杰:GLM-5.3在同一基座上扩大后训练
智谱AI唐杰称,GLM-5.3与GLM-5.2使用相同基座、架构及总参数和激活参数,主要通过一个月的长程环境与强化学习扩展后训练。
智谱AI唐杰表示,GLM-5.3与GLM-5.2采用相同基座、架构、总参数量和激活参数量,主要变化来自扩大后训练。
据其说明,团队用一个月时间扩展长程环境和强化学习,将GLM-5.3作为后训练Scaling Law的受控实验。这一表述说明能力提升并不只依赖增加参数,但属于研发团队的一手实验解释,不能替代独立基准复现。
来源:唐杰公开说明。