8月26日晚间,智谱宣布上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。壁仞科技基于生成式AI推理框架SGLang与成熟的BIRENSUPA™ 软件栈,在壁砺™166M上快速完成模型适配,率先向广大开发者及用户提供快速部署方案,以及高效稳定的长程任务体验。
GLM-5.3-Flash:极致低成本架构
根据官方介绍,GLM-5.3-Flash在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。
GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价却仅为后者的1/10。这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs320B),但激活参数量(32B→18B)与层数(92→45)几乎减半。结合智谱最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。

成熟软件栈快速完成适配
本次Day0适配中,针对GLM-5.3-Flash的文本理解与生成、图像理解以及高效推理能力,壁仞科技基于生成式AI推理框架SGLang与成熟的 BIRENSUPA™ 软件栈,在壁砺™166M上快速完成模型适配,打通了权重加载、服务启动、文本问答与图像理解等关键链路,并完成功能与精度验证。
同时,壁仞科技自研全栈多智能体平台SUPACODE™可自动解析并适配GLM-5.3-Flash的视觉编码器、语言模型解码层、线性注意力与稀疏注意力相结合的混合架构与MoE等关键模块,在此基础上快速打通推理全链路。
BIRENSUPA™深度兼容主流AI框架,开箱性能优异,可显著降低开发者的模型部署与应用门槛。随着人工智能领域应用需求的快速增长,壁仞科技作为国内领先的通用智能计算解决方案提供商,持续引领国产AI生态建设。截至目前,壁仞科技已成功支持数十款领先大模型的“Day0”级适配。依托高性能通用GPU产品与成熟软件生态,壁仞科技将加强与国产基础模型企业合作,以“国芯国模”协同发展为契机,共建国产AI生态,推动智能终端、AI智能体走向千行百业。