返回新闻列表
2026-08-28 19:43
AI123

智谱发布GLM-5.3-Flash大模型,性能超越DeepSeek V4 Pro

8月28日,智谱AI正式发布GLM-5.3-Flash模型。该模型即此前在OpenRouter匿名上线的Ox Alpha,也是GLM-5系列首个原生多模态模型,可接收文本、图片和视频输入并输出文本。


在发布前,Ox Alpha已以“野模”身份引发关注。8月20日上线后不到一天,它同时登顶OpenRouter和OpenCode两个调用量榜,创下OpenRouter模型发布纪录,终结了DeepSeek连续56天霸榜的纪录。


性能方面,GLM-5.3-Flash在Artificial Analysis Intelligence Index上获得57分,高于DeepSeek V4 Pro正式版的53分。智谱官方称,在某些口径下,其性能可对标此前Claude旗舰模型Opus 4.8。


定价上,GLM-5.3-Flash每百万Token缓存未命中输入价格为0.8元、输出2.8元,上线后提供两周限时半价优惠,优惠期间输入0.4元、输出1.4元,缓存命中输入0.115元,优惠持续至2026年9月9日24时。


该模型总参数为3200亿,但处理每个Token仅激活约180亿参数,占比5.6%。针对104万Token长上下文,它结合线性注意力与稀疏注意力以减少计算量。匿名测试期间,Ox Alpha单日处理量一度达约62万亿Token,线上流量全部由10万张国产芯片承担。智谱称,其在SGLang基础上搭建专用推理引擎,通过量化、并行和内存优化,使端到端服务性能较初始基线提升3倍,硬件效率和单Token成本已达到主流英伟达GPU水平。


此前DeepSeek于8月17日调整峰谷定价,部分时段涨幅最高达1100%。GLM-5.3-Flash以低价姿态上线,并采用国产算力方案,使大模型性价比竞争更加激烈。

来源
  1. 2026-08-28 03:15 | 36氪:“牛到家”的智谱,第一刀就砍向DeepSeek
    阅读原文

    当了这么久的“价格屠夫”,DeepSeek终于也等来了砍向自己的一刀。 动刀的,是智谱。 智谱AI刚刚发布的GLM-5.3-Flash,即是风靡海外社区的神秘大模型OX Alpha,也是GLM-5系列里的第一个原生多模态模型。 虽它的名字带着Flash,但性能可一点都不Flash,特别是在Artificial Analysis Intelligence Index上,它拿下57分,高于DeepSeek V4 Pro正式版的53分;连官方也毫不谦虚,说在某些口径上,性能甚至可以对标之前Claude 的旗舰Opus 4.8。 但GLM-5.3-Flash最震撼的莫过于:模型一...

其他新闻

查看全部