阿里发布并开源Qwen 3.8 Flash-Next模型
8月28日,阿里千问正式发布并开源新一代大模型Qwen 3.8 Flash-Next。该模型采用125B MoE架构,每Token仅激活约6B参数,原生支持262144 token上下文,并可通过YaRN扩展至1M token,被视为Qwen 4新架构的早期预演。
相比前代Qwen 3.7 Plus,Qwen 3.8 Flash将激活参数压缩至约三分之一,训练成本降至九分之一,同时在通用能力、数学推理与编程等维度均有提升。价格方面,Qwen 3.8 Flash每百万Tokens输入仅0.8元,输出2.7元,缓存命中0.1元,最低约为DeepSeek-V4-Flash价格的三分之一。
实测中,该模型在办公场景表现亮眼:不到2分钟即可完成四份不同平台的产品文案改写,不到4分钟即可将万字会议实录整理为总结、表格和通知邮件,且准确度较高。据开发者反馈,数据中心级的长文本处理能力在消费级4090显卡上也可运行。
目前,Qwen 3.8 Flash已在千问办公平台首发上线,API接口同步开放。该模型发布后迅速登上Huggingface榜首,成为开发者关注的焦点。
- 2026-08-28 21:19 | 华尔街见闻:实测比DeepSeek便宜的Qwen 3.8 Flash,卷飞了阅读原文
阿里千问新模型,又卷出了新水平。 他们发布并开源的Qwen 3.8 Flash-Next,不仅价格直接秒杀了DeepSeek-V4-Flash,而且刚发布便摘得了Huggingface榜首! 推上网友们也沸腾了,甚至还有工程师甩出实测视频直呼牛逼: Qwen 3.8 Flash踏平了VRAM的门槛,数据中心级的长文本大模型,在消费级4090显卡上也能跑了! 还有人已经兴冲冲地把它用到了工作中。 不到8分钟,它就跑完了涵盖Python编程、多表分析和研究报告生成的一整套工作流: 宝塔特效也不在话下: 哇奥,真有这么炫?我们当然也得上手试试。 每百万Tokens输入仅0.8元 Qwe...