智谱回应“只会后训练”质疑:下一代基座模型已在推进 GLM-6.0 瞄准“自进化”
金十数据 9 月 1 日讯,在 8 月 31 日晚间举办的 2026 年半年度业绩沟通会上,有分析师提出市场对智谱“只会后训练”的质疑,询问公司近期在参数规模上相对克制的原因。智谱创始人唐杰表示,下一代模型依旧会扩大基座规模,同时会对激活参数做管控,避免推理速度下滑和成本上升。算力层面,智谱披露,已实现 10 万级国产芯片规模化推理,单位 Token 推理成本较年初下降 80%。GLM‑5.3‑Flash 是智谱首款在超大规模真实流量下全面依托国产芯片集群提供服务的模型。公司称,对比同一硬件的初始基线,该模型端到端服务性能提升 3 倍。唐杰将未来 GLM-6.0 的一个方向概括为自进化,“这是一个很大的挑战,最大的问题是这个模型能自己判断自己什么时候停止,什么时候纠正自己,这是最大的问题,而不是简单地把模型训练大,在未来模型中,这是作为重点研究的”。(每经)
金十数据 9 月 1 日讯,在 8 月 31 日晚间举办的 2026 年半年度业绩沟通会上,有分析师提出市场对智谱“只会后训练”的质疑,询问公司近期在参数规模上相对克制的原因。智谱创始人唐杰表示,下一代模型依旧会扩大基座规模,同时会对激活参数做管控,避免推理速度下滑和成本上升。算力层面,智谱披露,已实现 10 万级国产芯片规模化推理,单位 Token 推理成本较年初下降 80%。GLM‑5.3‑Flash 是智谱首款在超大规模真实流量下全面依托国产芯片集群提供服务的模型。公司称,对比同一硬件的初始基线,该模型端到端服务性能提升 3 倍。唐杰将未来 GLM-6.0 的一个方向概括为自进化,“这是一个很大的挑战,最大的问题是这个模型能自己判断自己什么时候停止,什么时候纠正自己,这是最大的问题,而不是简单地把模型训练大,在未来模型中,这是作为重点研究的”。(每经)