大语言模型

智谱 GLM-5.4/5.5 路线曝光:参数冲上万亿,要学“自己训练自己”,还要当更长情的 Agent

2026年10月10日2 次阅读

智谱 GLM-5.4/5.5 路线曝光:参数冲上万亿,要学"自己训练自己",还要当更长情的 Agent

智谱的下一代大模型有新消息了。10 月 8 日,快科技、新浪科技、AIBase 等多家媒体集中报道:智谱创始人唐杰日前在新加坡的一次演讲中,披露了 GLM-5.4/5.5 两款新模型的研发方向。注意,这还是路线披露,不是正式发布,本文基于多家媒体转述整理。

先说结论:三个关键词——万亿参数、自己训练自己、更长情的 Agent。

第一个关键词:参数冲上万亿

唐杰提到,预训练的数据和规模会扩大,目标是做到"几个 T"。这意味着 GLM-5.4/5.5 的参数量会从目前 GLM-5.3 的 7400 多亿级别,提升到至少 1 万亿参数。规模越大,知识量和能力上限通常就越强——这是大模型竞争里少不了的一部分。

第二个关键词:后训练继续加强

智谱被网友称为"后训练仙人",GLM-5.3 就是在不换底座的情况下,靠后训练把编码和网络安全能力拉起来的。下一代模型会继续强化 SFT、RLHF、RLVR 等强化学习训练。

第三个关键词,也是最值得注意的:两条新路

唐杰认为,现在的 AI 已基本不需要卷对话、卷写代码了。GLM-5.4/5.5 要走的是两条还没人走透的路:

  • RSI 自主迭代升级:模型能"自己训练自己"。智谱在 8 月底的财报会议上就提出过 fully self-training(完全自训练)的概念,美国同行把这叫 RSI(递归自我改进)。从预训练到中训练再到后训练,模型都可以自我进化。但这里有个最大的难题:模型要能自己判断"什么时候停止、什么时候纠正自己"。按媒体转述,GLM-5.4/5.5 不会实现得这么彻底,应该只会有部分 RSI 成果,完全自主的 RSI 进化还得等。
  • 更长更自主的 Agent:环境更复杂、任务更难、周期更长,给模型更大的思考和操作空间,往长程任务和自主智能体推进。简单说,就是让 AI 能连续干上好几天、不用人一直盯着。

这对普通人意味着什么

如果你用智谱的模型写代码、跑任务,下一代模型的方向不是"回答得更好",而是"能自己接着干"。你交给它一个目标,它能拆步骤、自己执行、自己纠错,周期从几分钟拉长到几天。对话和 Coding 只是及格线,长程自主任务才是下一代模型的考场。

对行业来说

这标志着国产头部大模型的重点从"卷对话、卷 Coding"转向"卷自我进化 + 长程 Agent",与 OpenAI 等对 RSI 的定义对齐——模型自己进化自己,被普遍视为通往更强 AI 的关键一步,也是争议最大的一步。

冷静看待

目前这些信息都来自唐杰的演讲转述,不是智谱的官方发布公告。GLM-5.4/5.5 的具体发布时间、参数细节、实际能力都还没有官方确认。建议以智谱/Z.ai 官方后续公告为准。本文基于多家媒体转述整理。

信息来源

  • 快科技:智谱暗示新一代 GLM-5.4/5.5 大模型(2026-10-08)- https://news.mydrivers.com/1/1155/1155996.htm
  • 新浪科技转载(2026-10-08)- https://finance.sina.com.cn/tech/roll/2026-10-08/doc-iniuphpf3695088.shtml
  • AIBase:Zhipu AI's New Generation Large Model Roadmap Revealed(2026-10-09)- https://news.aibase.com/news/31498
  • xix.ai:Zhipu unveils GLM-5.4 and GLM-5.5(2026-10-08)- https://xix.ai/live/7753

评论

0 条已公开
登录或注册后可以参与评论。

正在加载评论...