智谱
智谱官方号
老虎认证: 让机器像人一样思考
IP属地:未知
0关注
32806粉丝
让机器像人一样思考
avatar智谱
09-01
智谱2026中报发布:智能上界,新局加载
avatar智谱
08-27

GLM-5.3-Flash:前沿智能进入普惠时代

今天,我们上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。 大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash来了:320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。 与此同时,GLM-5.3-Flash定价为1/10的GLM-5.3,限时折扣内为1/20的GLM-5.3,为Opus 4.8的1/40。同样智力,1/40价格,前沿智能,第一次不需要省着用。 为收集广大用户的广泛、专业反馈,我们在正式发布前,以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。 GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价却仅为后者的1/10。这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合我们最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。 GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准
GLM-5.3-Flash:前沿智能进入普惠时代
avatar智谱
09-21 09:53

ZCode开源

针对社区反馈的 ZCode 产品安全问题,我们已经完成整改,并向所有用户道歉。我们已将 ZCode 开源 (https://github.com/zai-org/ZCode),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云OSS存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确认 zcode-prod (阿里云对象存储OSS) 内全部数据对象及存储桶本身已删除。ZCode v3.14.0 客户端已完成整改,Repo Wiki 入口及相应生成链路已移除,未发现可触发本地仓库快照或文件外发的功能路径。 再次向大家致歉,请大家持续监督。
ZCode开源
avatar智谱
09-18

GLM-5.3-FlashX上线:大大方方、好好用用、嗖嗖嗖嗖

GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,我们在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。 今日起,我们正式推出GLM-5.3-FlashX(最高200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。GLM-5.3-Flash长期保持同尺寸最强智能水平,并具备极高性价比,本次提速进一步形成智能、价格、速度的全面竞争力。 GLM-5.3-FlashX API现已上线,Model Key:GLM-5.3-FlashX。 使用方式: API调用:https://docs.bigmodel.cn/api-reference/模型-api/对话补全 体验中心:https://www.bigmodel.cn/trialcenter/modeltrial/visual?modelCode=glm-5.3-flashx
GLM-5.3-FlashX上线:大大方方、好好用用、嗖嗖嗖嗖

去老虎APP查看更多动态