价格砍至四十分之一!智谱开源原生多模态大模型GLM-5.3-Flash
近日,智谱正式上线并开源GLM-5系列首款原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能与极致定价,推动前沿人工智能技术走向普惠。
该模型实力跻身全球前沿梯队,在Artificial Analysis Intelligence Index测评中获得57分,与Claude Opus4.8持平,编程能力表现相当,综合性能超越参数量更大的GLM-5.2。正式发布前,模型以匿名身份“Ox-Alpha”开展公开测试,登顶OpenCode、OpenRouter平台调用榜。
成本优势是核心亮点。GLM-5.3-Flash定价仅为同系列GLM-5.3的十分之一,限时折扣低至二十分之一,相当于Opus4.8价格的四十分之一,大幅降低前沿模型使用门槛。
架构层面,模型采用稀疏注意力与线性注意力混合架构,为首个落地该方案的开源前沿模型,搭配流形约束超连接技术。相比前代,注意力计算量下降3.01倍,KV缓存缩减4.44倍,兼顾长上下文能力与推理成本。同时原生融合视觉能力,可自主利用视觉反馈完成前端开发、3D建模、文档创作等任务,在金融研报、法律文书等专业场景表现突出。
值得关注的是,模型全量流量由国产芯片集群承载。团队自研推理引擎,依托EPD分离架构与多项内存优化方案,端到端推理性能提升3倍,硬件使用效率比肩英伟达主流GPU,印证国产算力支撑大规模前沿模型推理的可行性。
目前GLM-5.3-Flash已全面开源,开放API接口、在线体验渠道,并上线ZCode、AutoClaw等智能Agent平台,同步推出每日万张体验卡,面向全球开发者开放使用。
在线体验
Z.ai:https://chat.z.ai
智谱清言App:https://chatglm.cn
via AI新闻资讯 (author: AI Base)
近日,智谱正式上线并开源GLM-5系列首款原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能与极致定价,推动前沿人工智能技术走向普惠。
该模型实力跻身全球前沿梯队,在Artificial Analysis Intelligence Index测评中获得57分,与Claude Opus4.8持平,编程能力表现相当,综合性能超越参数量更大的GLM-5.2。正式发布前,模型以匿名身份“Ox-Alpha”开展公开测试,登顶OpenCode、OpenRouter平台调用榜。
成本优势是核心亮点。GLM-5.3-Flash定价仅为同系列GLM-5.3的十分之一,限时折扣低至二十分之一,相当于Opus4.8价格的四十分之一,大幅降低前沿模型使用门槛。
架构层面,模型采用稀疏注意力与线性注意力混合架构,为首个落地该方案的开源前沿模型,搭配流形约束超连接技术。相比前代,注意力计算量下降3.01倍,KV缓存缩减4.44倍,兼顾长上下文能力与推理成本。同时原生融合视觉能力,可自主利用视觉反馈完成前端开发、3D建模、文档创作等任务,在金融研报、法律文书等专业场景表现突出。
值得关注的是,模型全量流量由国产芯片集群承载。团队自研推理引擎,依托EPD分离架构与多项内存优化方案,端到端推理性能提升3倍,硬件使用效率比肩英伟达主流GPU,印证国产算力支撑大规模前沿模型推理的可行性。
目前GLM-5.3-Flash已全面开源,开放API接口、在线体验渠道,并上线ZCode、AutoClaw等智能Agent平台,同步推出每日万张体验卡,面向全球开发者开放使用。
在线体验
Z.ai:https://chat.z.ai
智谱清言App:https://chatglm.cn
via AI新闻资讯 (author: AI Base)