算力松绑之后:智谱下一代模型的四张技术牌
@格雷费舍:
智谱刚完成50亿美元"小股大债"再融资——30亿美元负利率可转债,投资人倒贴利息也要押注;T+2当天股价不降反升。今天电话会上管理层确认:本轮扩容后,算力已能支撑业务高速增长和更大规模模型的持续研发。 对一家模型公司,这句话的分量怎么强调都不过分。过去大半年,智谱的技术故事一直是"戴着镣铐跳舞"——模型再好,算力跟不上,一切创新都要排队。 而算力松绑的那一刻,真正值得期待的不是"现状改善",而是被解锁的那些原本不敢想的技术选项。 梳理下来,智谱手里其实已经攥着四张技术牌,只是过去没有算力把它们打出去。 第一张牌:更大的模型,已经在路上 电话会透露了一个此前半公开的信息:公司已经启动更大尺寸模型的训练。这句话放在智谱的迭代史里读,意味着GLM-6的前置工程已经开工。 算力账解释了为什么这张牌必须等算力到位才能打:训练新一代旗舰需要的算力规模,远超现有集群的富余量——此前GLM-5.3和5.3-Flash发布带来的数倍调用量增长,已经把推理侧的优化空间"压榨殆尽",训练侧再要抽调先进算力,就是拆东墙补西墙。只有扩容之后,训练与推理才能各归各位,下一代模型的预训练才有稳定的算力供给。 对"更大模型"要不要期待?行业吵了两年Scaling Law见不见顶。但智谱的证据链站在乐观一侧:GLM-5到GLM-5.3,六个月五代,每一代的能力跃迁都真实可测(AA智力指数从旗舰档到Flash档全面上探,Flash已经摸到上代旗舰的水位)。在这条斜率上,更大的模型值得等。 第二张牌:长程Agent,算力密集型的能力高地 第二张牌藏在Co-work叙事的底部。电话会用一段容易被忽略的话描述安全场景:多智能体漏洞挖掘、真实业务安全研究、复杂漏洞研究——这些任务的本质是长程多步推理:模型要反复试错、多轮验证、自主回溯。 这类能力的训练和推理都是算力黑洞:训练侧需要海量Agent轨迹的探索(电话会里说