智谱AI今天宣布,GLM-5.3-Flash正式开源。这款模型拥有3200亿总参数、180亿激活参数,是原生多模态模型。摩尔线程当天就完成了适配,MTT S5000加速卡可以直接运行。在综合智能指数测试中,它拿到57分,与Claude Opus 4.8持平;代码能力也处于同一水平。开源社区反响热烈。
GLM-5.3-Flash到底强在哪?
先看硬参数。GLM-5.3-Flash是GLM-5系列里第一个原生多模态模型,总参数量3200亿,激活参数只有180亿。这意味着它既能处理文本、图像这些多模态任务,又不需要把所有参数都跑一遍,推理成本低了不少。
在Artificial Analysis的综合智能指数测试里,它拿了57分,和Anthropic的Claude Opus 4.8一模一样。编程方面,Z.ai的Code Bench评估显示,它的代码生成和调试能力跟Claude Opus 4.8相当。要知道Claude Opus 4.8是闭源顶级模型,现在一个开源模型能追平它,确实不简单。
其实这模型之前就露过脸。它曾以代号Ox-Alpha在OpenCode和OpenRouter平台上匿名公测,结果直接成了当周最受欢迎模型,还顺手刷新了两个平台的调用量纪录。当时大家还在猜是哪家的大佬,现在真相大白。
摩尔线程的当天适配,藏着什么技术细节?
模型发布当天,摩尔线程就宣布完成适配,速度惊人。他们做了架构分析和算子梳理,重点盯上了线性注意力里的KDA机制。基于MATE优化引擎,他们开发并调优了新算子,再跟SGLang-MUSA缓存体系协同,把长上下文推理效率提了一大截。
这意味着什么?意味着国产GPU也能跑这种级别的开源模型了。MTT S5000加速卡配合MUSA软件栈,不是简单“能跑”,而是针对模型特性做了深度优化。对于担心硬件卡脖子的团队来说,这是个好消息。
开源模型跑起来,企业怎么选?
模型开源了,但真要部署到生产环境,还是得考虑算力和运维。自己买卡搭集群?成本高、周期长。更省心的路子是直接上云。比如用云服务器ECS,几分钟就能拉起一个高配实例,配合弹性伸缩,忙时多开几台,闲时缩回去,钱花在刀刃上。
如果你正好在规划企业上云,不妨找阿里云代理商聊聊。通过他们能拿到阿里云优惠和阿里云代金券,把上云成本再压一截。比如我们合作过的易枫顺 - 阿里云官方旗舰级代理商,服务挺到位,能帮你选型、搭环境,省下不少折腾的时间。
当然,如果你有技术团队,也可以自己部署到裸金属服务器上。但说实话,云上更灵活,尤其是模型迭代这么快,今天GLM-5.3-Flash,明天可能就有新版本,云上切换起来方便。
FAQ
Q: GLM-5.3-Flash和GLM-5系列其他模型有什么区别?
A: 它是GLM-5系列首个原生多模态模型,总参数量3200亿,激活参数量180亿。相比同系列其他模型,它在多模态理解和生成上更全面,同时保持了较低的推理开销。
Q: 摩尔线程的适配对普通用户有什么实际意义?
A: 意味着你不一定非得买国外高端GPU才能跑这个模型。摩尔线程MTT S5000加速卡加MUSA软件栈就能高效运行,国产硬件也能顶上来,成本上会友好很多。
Q: 这个模型的编程能力到底怎么样?
A: 在Z.ai的Code Bench评估中,它的编程能力与Claude Opus 4.8相当。之前匿名公测时,它刷新了OpenCode和OpenRouter的调用量纪录,编程这块是经过实战检验的。
Q: 想部署GLM-5.3-Flash,有哪些方式?
A: 可以用自己的GPU服务器部署,也可以直接用云服务器ECS。如果想省事,通过阿里云代理商购买云资源还能享受阿里云优惠和阿里云代金券,适合快速启动项目。
关于易枫顺
深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺
来源:IT之家