TwKit

推文

@NFT_Chen · 2026-10-08 17:45

🚨重磅披露:唐杰提前透露 GLM-5.4/5.5 将动手改自己,智谱下一程不卷聊天,直接冲 RSI ! 唐杰明确把接下来 GLM 5.4/5.5 的 Scaling 收成三刀: 1️⃣预训练继续加码:数据和模型再放大,目标做到几 T 级,先把智能上限抬上去。 2️⃣后训练打深:SFT / RLHF / RLVR(可验证奖励强化学习)一起上,对齐和推理继续拉,GLM-5.3 已经验证这条路能涨分。 3️⃣推理和智能体加长:环境更复杂、任务更难、周期更长,给模型更大的思考和操作空间,往长程任务和自主智能体推进。 他认为知识、对话、Coding 基本已被攻克,GLM-5.4/5.5 要抢的,是还没涌现的两块: 🔹RSI 自迭代, 🔹更长、更自主的 Agent 聊天已经不是战场,下一版拼的是模型能不能改自己了。 #GLM5_4 #GLM5_5 #智谱 #唐杰 #RSI #后训练 #NUS #Zai #Zcode

曝光 8978 · 评论 22 · 点赞 60 · 书签 28 · 曝光/时 1605.0674280611029