2026-09-18 13:15
AI123

智谱发布GLM-5.3-FlashX大模型,生成速度最高200 tokens/s

9月18日,智谱正式推出GLM-5.3-FlashX模型,API现已上线。该模型支持最高200 tokens/s的生成速度,并基于10万张国产芯片提供的推理算力运行。

智谱官方介绍,GLM-5.3-Flash此前以“Ox Alpha”之名面向全球开发者开放,获得海内外开发者广泛认可,调用量持续攀升。为应对快速增长的需求,智谱在现有推理算力基础上加大了对Infra侧的投入,并针对推理过程进行优化。官方称,GLM-5.3-Flash长期保持同尺寸模型的领先智能水平,本次提速后在智能、价格、速度方面形成综合竞争力。

目前,开发者可通过智谱开放平台调用GLM-5.3-FlashX,Model Key为“GLM-5.3-FlashX”。

来源
  1. 2026-09-18 12:48 | 界面新闻:智谱推出GLM-5.3-FlashX
    阅读原文

    9月18日,智谱正式推出GLM-5.3-FlashX(最高200 tokens/s)。GLM-5.3-FlashX API现已上线,Model Key:GLM-5.3-FlashX。

  2. 2026-09-18 12:45 | 新浪财经:智谱 GLM-5.3-FlashX 模型上线,更快、更流畅
    阅读原文

    IT之家 9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。GLM-5.3-FlashX API 现已上线,Model Key:GLM-5.3-Flas...

其他新闻

查看全部