Day-0 支持:摩尔线程官宣完成智谱 GLM-5.3-Flash 极速适配
智谱近日上线并开源 GLM-5.3-Flash (320B-A18B)。摩尔线程官方今日宣布,基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,实现了对该模型的极速适配与高效运行。
8 月 27 日消息,智谱近日上线并开源 GLM-5.3-Flash (320B-A18B)。摩尔线程官方今日宣布,基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,Day-0 支持,实现了对该模型的极速适配与高效运行。
据介绍,作为 GLM-5 系列的首个原生多模态模型,GLM-5.3-Flash 总参数为 320B,激活参数仅 18B,在全球权威的 Artificial Analysis Intelligence Index(AA 综合智能指数)中取得 57 分,进入全球前沿模型能力区间,与 Anthropic 最受欢迎的模型 Claude Opus 4.8 得分持平。在自研 Z.ai Code Bench 体感评估中,其编程表现与 Claude Opus 4.8 相当。

此前,该模型以代号 Ox-Alpha(社区昵称“牛来”)在 OpenCode 和 OpenRouter 进行匿名公测,凭借出色的推理速度与智能表现,迅速成为当周最受欢迎的模型,创下双平台调用量新高。
GLM-5.3-Flash 发布当日,摩尔线程工程团队完成模型架构拆解、核心技术分析与典型算子梳理。针对其混合架构中线性注意力采用的 KDA 机制,团队基于 MATE 算子优化引擎,快速完成了状态矩阵更新、分块并行扫描等全新算子形态的定制实现与深度调优,并与 SGLang-MUSA 缓存管理体系深度协同、无缝打通,释放了 KDA 在长上下文推理中的效率优势。

附 GLM-5.3-Flash 开源地址:
如果您对本站有任何建议,欢迎您提出来!本站部分信息来源于网络,如果侵犯了您权益,请联系我们删除!
微信客服