智谱AI于2026年8月26日晚间正式发布原生多模态大模型GLM-5.3-Flash。苏州登临科技股份有限公司自主研发的KS系列高性能通用GPU已完成对GLM-5.3-Flash的适配测试及基于登临超异构架构的能效优化,实现Day0级别的支持。
01GLM-5.3-Flash:前沿能力,更低成本
GLM-5.3-Flash是GLM-5系列中首个支持图像、视频、文件多模态输入的开源模型。正式发布前,该模型以匿名代号Ox-Alpha(中文社区昵称 "牛来")在OpenCode与OpenRouter平台进行测试,创下双平台调用量新高。
GLM-5.3-Flash总参数量为320B,综合能力优于GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间。
在能力提升的基础上,GLM-5.3-Flash进一步降低了使用成本,使前沿大模型能力扩展至更高频、更广泛的实际应用。
02GPU 架构:能效领先、生态兼容
登临KS系列可实现Day0适配,源于其在大模型生态领域的长期深耕与高效响应机制。目前,登临软件栈已完成DeepSeek、MiniMax、Kimi、GPT-OSS、LTX、Qwen等多款国内外主流大模型的适配,积累了深厚的计算优化与工程部署经验,能够在GLM-5.3-Flash发布后第一时间完成特性拆解与定向调优。
基于创新的GPU 架构,登临构建了覆盖端到云的完整KS系列产品矩阵:
KS58、KS38云端算力卡专为大模型推理设计,单卡最高 128GB 显存,可实现单服务器内全上下文长度推理,显著降低部署门槛与运营成本;KS28方案广泛应用于智慧城市与行业大模型场景,兼顾常规模型性能与大模型通用适配能力;KS20系列则以体积小巧、典型功耗仅 25W 的优势,适配边缘计算与实时交互场景。
作为国产高性能通用GPU领军者,登临GPU 架构融合了传统GPU的通用性与ASIC的高效率,核心优势体现在四个维度:
1. 卓越能效比:在典型 AI 场景下性能领先国际主流旗舰产品1.5-4.5倍,能效比达竞品3-5倍;
2. 高度生态兼容:支持 CUDA/OpenCL 等现有软件生态,算法模型可平滑迁移;
3. 强大算力与大显存支持:纳适系列加速卡提供70 TOPS 至 560 TOPS 有效 AI 算力及8GB 至 128GB 显存配置,可应对各类计算密集型任务。
登临科技以Day0级适配能力与硬核能效优化实力,完美承接GLM-5.3-Flash的前沿模型能力,实现了高端AI算力与新一代多模态大模型的精准适配、高效联动。立足国产自主创新赛道,此次技术融合将持续释放算力价值,持续完善国产AI生态,助力前沿智能技术从技术突破走向产业普及,推动新质生产力在AI领域加速落地。
关于登临科技
苏州登临科技股份有限公司是国内首个实现规模商业落地的 GPU 企业,专注于高性能通用 GPU 研发与应用。以 “GPU ” 为技术核心,为大模型计算,推理云,智慧城市,智慧工业,AIPC等领域提供高效、通用、安全的算力解决方案,致力于成为 AI 产业化落地的关键算力基础设施提供者。
免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
如有疑问请发送邮件至:bangqikeconnect@gmail.com