返回新闻列表
2026-08-26 22:50
AI123

智谱开源320B参数原生多模态大模型GLM-5.3-Flash

GLM模型开源智谱

8月26日,智谱宣布上线并开源GLM-5.3-Flash(320B-A18B)。这是GLM-5系列首个原生多模态模型,总参数规模达320B,综合能力超过上一代GLM-5.2。

在Artificial Analysis Intelligence Index(AA综合智能指数)评测中,GLM-5.3-Flash取得57分,进入全球前沿模型能力区间,与Anthropic旗下Claude Opus 4.8得分持平。此外,在智谱自研的Z.ai Code Bench体感评估中,该模型的编程表现也与Claude Opus 4.8相当。

定价方面,GLM-5.3-Flash的定价为GLM-5.3的1/10,限时折扣期间为GLM-5.3的1/20,相当于Opus 4.8的1/40。

来源
  1. 2026-08-27 17:02 | 新浪财经:“牛来”真身曝光,智谱股价大涨,公司:全部线上流量由10万张国产芯片承载,优化后可比肩主流英伟达GPU
    阅读原文

    8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时...

  2. 2026-08-27 12:06 | 华尔街见闻:调用量超DeepSeek两倍、57分比肩Opus 4.8:智谱“牛来”推动股价盘中涨超9%
    阅读原文

    智谱旗下神秘模型Ox Alpha正式现身,带动公司股价大幅走高,并以国产芯片全量承载海量推理流量的披露,在AI硬件领域引发广泛关注。 周四,智谱股价盘中涨超9%,报1124港元。消息面上,智谱8月26日正式确认,此前在开发者社区引发热议的匿名模型Ox Alpha——中文社区称"牛来",即为其最新发布的GLM-5.3-Flash(320B-A18B)。该模型在Artificial Analysis Intelligence综合智能指数中取得57分,与Anthropic的Claude Opus 4.8持平,高于DeepSeek旗舰模型V4 Pro正式版的53分。 在正式发布前,GLM-5.3-F...

  3. 2026-08-27 12:00 | 新浪财经:国产大模型从能力迭代走向成本竞争,南方基金重视科技成长持有体验
    阅读原文

    8月26日晚间,GLM-5.3-Flash上线并开源。该模型为GLM-5系列首个原生多模态模型,参数规模为320B,支持百万上下文,定价约为GLM-5.3的十分之一。发布前,该模型曾以匿名模型进行公开测试,测试期间请求流量全部由国产芯片提供算力支持,相关平台过去7天调用量达到23.2T,另一平台累计调用量达到44T。大模型竞争正在从单纯比拼参数和榜单,进入模型能力、推理成本、国产芯片适配和开发者生态共同验证阶段。开源降低了开发者使用门槛,国产算力承载则为后续模型部署、云服务和端侧应用提供更多选择。但商业化仍要看付费转化、企业场景落地和推理成本能否持续下降。AI应用热度上升时,投资者容易被单一模...

  4. 2026-08-27 11:53 | 新浪财经:智谱GLM-5.3-Flash发布,推理流量由国产芯片支持,人工智能主题指数强势涨超3%
    阅读原文

    截至2026年8月27日午间收盘,中证人工智能主题指数(930713)强势上涨3.46%,成分股澜起科技(219.860, 18.86, 9.38%)上涨9.38%,芯原股份(194.110, 13.61, 7.54%)上涨7.54%,海光信息(246.000, 15.04, 6.51%)上涨6.51%,光迅科技(177.800, 9.92, 5.91%)、复旦微电(54.240, 2.98, 5.81%)等个股跟涨。消息面上,8月26日晚间,“国产大模型”智谱上线并开源GLM-5系列的首个原生多模态模型GLM-5.3-Flash (320B-A18B),并官宣表示近期在OpenRouter使...

  5. 2026-08-27 11:37 | 界面新闻:英伟达Q2营收翻倍再超预期,AI算力浪潮驱动产业链共振,创业板人工智能ETF大成(159242)标的指数强势大涨超3.5%
    阅读原文

    有连云快讯 15分钟前 截至2026年8月27日 11:17,创业板人工智能ETF大成(159242)跟踪指数创业板人工智能指数(970070)强势上涨3.56%。 截至2026年8月27日 11:17,创业板人工智能ETF大成(159242)跟踪指数创业板人工智能指数(970070)强势上涨3.56%,成分股长芯博创上涨14.06%,致...

  6. 2026-08-27 10:41 | 财联社:10万张国产算力卡扛起“牛来”:智谱开源GLM-5.3-Flash
    阅读原文

    《科创板日报》8月27日讯(记者 李明明)谜底如期揭晓。8月26日晚,智谱宣布上线并开源GLM-5.3-Flash(320B-A18B),并官方确认其正是过去一周刷屏海外开发者社区的匿名模型Ox-Alpha——中文社区称之为“牛来”。该模型为GLM-5系列首个原生多模态模型,总参数320B、激活参数仅18B,采用MIT协议开放权重,上线即登陆Hugging Face。 8月20日,Ox-Alpha以“隐身模型”身份悄然上线全球最大模型聚合平台OpenRouter,首日调用量即登顶并创下单日历史纪录,同时终结DeepSeek在OpenCode长达56天的霸榜,单日处理tokens达62T,迅速成...

  7. 2026-08-27 10:20 | 新浪财经:智谱、MiniMax国产模型进展超预期,且进一步与国产芯片绑定,国产AI芯片需求空间继续打开
    阅读原文

    今日国产模型再添进展,智谱新发布的GLM-5.3-Flash首次在大规模流量中尝试用大国产芯片集群提供服务,且内测阶段大规模流量全部跑在国产芯片集群。同时,MiniMax也在推进M3模型、H3模型的国产芯片适配,并表示大规模国产算力集群将很快上线,将逐步承接真实生产流量。机构分析认为,模型厂商的经营数据更值得关注:1)MiniMax管理层称8月ARR已超过8亿美元,其中企业端占80%;2)用户数从2025年底的20万增至目前200万,1-7月Token消耗增长20倍。商业化和用户活跃加速,意味着模型调用正在转化为可观察的推理负载和集群扩容需求。3)公司同时正积累算力,目标在2027年训练10T...

  8. 2026-08-27 10:15 | 界面新闻:英伟达财报超预期,明年营收预计再增70%!智谱官宣“牛来”模型使用国产芯片!DeepSeek重启第二轮融资?今年营收4.75亿、增长9倍!
    阅读原文

    万众瞩目的英伟达财报终于公布。公司2027财年第二季度营收与业绩指引均高于市场预期,盘后大涨4.7%。AI算力产业链依旧高景气,科创芯片ETF汇添富(588750)标的指数高开震荡。科创芯片ETF汇添富(588750)标的指数涨跌不一,海光信息涨超5%,寒武纪涨超2%,澜起科技、源杰科技等涨超1%,中微公司等微涨,中芯国际、华海清科等回调。【科创芯片ETF汇添富(588750)标的指数前十大成分股】截至9:42,成分股仅做展示使用,不构成投资建议。国内消息方面,8月26日晚间,“国产大模型”智谱上线并开源GLM-5系列的首个原生多模态模型GLM-5.3-Flash (320B-A18B),并官...

  9. 2026-08-27 09:37 | 新浪财经:智谱GLM-5.3-Flash发布,10万张国产卡撑起海内外线上流量
    阅读原文

    新浪科技讯 8月27日上午消息,智谱宣布上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。   据悉,GLM-5.3-Flash能力打平Opus 4.8,但价格是Opus 4.8的1/40。仅320B尺寸能力便超过GLM-5.2,AA大概分数为57分。   目前,GLM-5.3-Flash全部流量由10万张国产芯片承载,在发布前,该模型以匿名身份Ox-Alpha在OpenRouter、OpenCode两大海外平台测试,登顶并刷新双平台历史纪录,Token调用量高达62T,并且这些请求流量全部由国产芯片提供算力支持。这是国产算力芯片首次大规模集...

  10. 2026-08-27 09:09 | 21财经:MiniMax 8月ARR冲破8亿美元;智谱开源GLM-5.3-Flash丨港股早报
    阅读原文

    要闻精选MiniMax 7月Token消耗量飙至年初20倍 8月ARR冲破8亿美元MiniMax 8月26日晚在2026年中期业绩会上披露,公司8月年度经常性收入(ARR)已超过8亿美元,第二季度收入环比增长81.8%,7月Token消耗量已达到1月的20倍,B端业务在整体ARR中的占比已超过80%。MiniMax称,在算力上,公司是国内最早建立规模化、长期稳定基础设施体系的两家独立大模型公司之一。基础设施已能独立支撑最大的训练任务,ETTR(Effective Training Time Ratio,有效训练时间比例)已经达到97%。智谱开源GLM-5.3-Flash 系匿名模型“牛来”据财...

  11. 2026-08-27 08:52 | 36氪:智谱“牛来”模型算力谜底:全部国产卡承载,价格仅为Opus 4.8的1/40
    阅读原文

    匿名六天之后,“牛来”终于揭开了最后一层面纱。 8月26日晚,智谱正式发布并开源GLM-5.3-Flash。这款此前以Ox-Alpha身份在OpenRouter、OpenCode匿名测试的模型,总参数量320B、激活18B,是GLM-5系列首个原生多模态模型。 与GLM-5.3相比,这个模型的价格低到有些出乎意料,它的价格仅为GLM-5.3的1/10,限时折扣期进一步降至1/20;与Anthropic旗舰模型Claude Opus 4.8相比,约为1/40。 Artificial Analysis目前给Claude Opus 4.8的Intelligence Index评分为...

  12. 2026-08-27 08:22 | 华尔街见闻:智谱新模型“牛来”跑在10万国产卡上,SemiAnalaysis评价“英伟达护城河再受考验”
    阅读原文

    8月26日,智谱正式确认:此前在开发者社区引发热议的匿名模型Ox Alpha(中文社区称“牛来”),就是其最新发布的GLM-5.3-Flash。模型代号灵感来源于国内近期热映电影《牛来》。 这个模型在正式亮相前,以匿名形式在OpenRouter和OpenCode上免费开放测试,5天内流量累计超过50万亿token,刷新了两个平台的流量增长纪录,当前使用量已超过DeepSeek的两倍以上。但真正引发市场关注的,是智谱随后披露的一个细节:这些流量,全部由国产芯片承载。 智谱在官方技术文档中表示,调用超过10万张国产芯片集群用于该模型推理服务,“硬件效率及单token成本已经达到了与主流英伟达GPU...

  13. 2026-08-27 01:28 | 华尔街见闻:智谱推出对标DeepSeek的轻量旗舰模型,由10万国产卡支持
    阅读原文

    智谱发布旨在对标 DeepSeek V4 Flash 的轻量级旗舰模型 GLM-5.3 Flash ,调用超过 10 万张国产芯片集群用于该模型推理服务。据《晚点 LatePost》了解,其算力供应商或来自华为、摩尔线程与海光,智谱官方没有评论这一信息。 GLM-5.3 Flash拥有300B 参数规模,参数量约为 GLM-5.3 的 40%,与 DeepSeek V4 Flash 几乎持平。与同代小尺寸模型往往蒸馏自大模型不同,GLM-5.3 Flash 采用与 GLM-5.3 不同的架构设计,具有原生多模态能力,支持图像视频输入,这也是智谱战略聚焦 coding 以来第一次推出具有多模态能...

  14. 2026-08-26 22:53 | 新浪财经:智谱上线并开源GLM-5.3-Flash,系此前Ox-Alpha(中文社区称作牛来)模型
    阅读原文

    (来源:北京商报)北京商报讯(记者 王天逸)8月26日,北京商报记者获悉,智谱正式上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。资料显示,该模型拥有320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。与此同时,GLM-5.3-Flash定...

  15. 2026-08-26 22:21 | 新浪财经:Ox Alpha 现身:智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
    阅读原文

    IT之家 8 月 26 日消息,智谱今晚上线并开源 GLM-5.3-Flash (320B-A18B),这是 GLM-5 系列的首个原生多模态模型。该模型总参数量为 320B(3200 亿),激活参数仅 18B(180 亿)。智谱在正式发布前,以匿名模型 Ox-Alpha(中文社区称作牛来)在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。GLM-5.3-Flash 能力超过 GLM-5.2,在全球权威的 Artificial Analysis Intelligenc...

  16. 2026-08-26 22:20 | 界面新闻:智谱上线并开源GLM-5.3-Flash
    阅读原文

    8月26日,智谱上线并开源GLM-5.3-Flash (320B-A18B)。据介绍,这是GLM-5系列的首个原生多模态模型,320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。与此同时,GLM-5.3-Flash定价为GLM-5.3的1/10,限时折扣内为GLM-5.3的1/20,为Opus...

  17. 2026-08-26 20:29 | 36氪:智谱认领“牛来”模型,实测:“牛马”友好
    阅读原文

    过去一个周末,全球 AI 开发者都在追问同一个问题:突然出现在 OpenRouter 上的神秘模型 Ox Alpha,究竟来自哪家实验室? 它没有公布开发者,没有披露参数规模,也没有给出技术报告,只以“匿名模型”的身份开放使用。 但在短短几天内,Ox Alpha 迅速冲上 OpenRouter 热门榜单,并凭借代码生成、复杂推理和长时间 Agent 任务中的表现,引发了大量猜测。 “牛来”模型谜底揭晓,是 GLM-5.3-Flash 现在,谜底终于揭晓。 昨天晚上,智谱正式确认:Ox Alpha 正是其最新发布的 GLM-5.3-Flash。过去一周在海外开发者社区引起轰动...

  18. 2026-08-26 17:43 | 36氪:神秘「牛来」模型果然是智谱,GLM首个原生多模态,还用的国产卡
    阅读原文

    终于,这几天在网上炒得沸沸扬扬的神秘模型「牛来」(Ox Alpha),真身曝光了! 而且果然是来自中国玩家—— 是智谱刚刚发布即开源的GLM-5.3 Flash,还是5系列里首个原生多模态的那种。 「牛来」在火的这几天里啊,其实已经有不少人用Ox Alpha这个版本在实测了。 其中玩儿得比较多的,便是手搓一个SpaceX Raptor猛禽发动机3D交互网页。 例如博主Tim Jayas时隔几日,用同样的Prompt让「牛来」做了两次这个任务后,直接发出了这样的感慨: 感觉「牛来」是一个能自己持续学习的模型。 巧了,我们刚好也拿到了GLM-5...

  19. 2026-08-26 17:42 | 36氪:千问智谱连夜开源,都比DeepSeek便宜,国产大模型价格猛卷
    阅读原文

    智东西8月27日报道,昨晚,阿里千问大模型团队开源多模态MoE模型Qwen3.8-Flash-Next,该模型是基于下一代Qwen4架构构建的先导预览版。 Qwen3.8-Flash-Next主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数,原生支持262144 token上下文,并可通过YaRN扩展至1百万token。 相比于Qwen3.7-Plus,Qwen3.8-Flash-Next降低了训练与推理成本,训练开销仅约为前者的1/9,但在编程和办公任务上性能更强,且该模型在千问团队放出的基准测试中绝大多数都超过DeepSeek-V4...

其他新闻

查看全部