返回新闻列表
2026-08-27 09:15
AI123

阿里千问Qwen3.8-Flash API定价公布,输入输出均低于DeepSeek-V4-Flash

阿里巴巴DeepSeek模型Qwen

8月26日晚,阿里千问大模型团队开源了Qwen3.8-Flash-Next模型,并同步公布了Qwen3.8-Flash的API服务定价。根据定价方案,Qwen3.8-Flash每百万Tokens输入价格为1元,输出价格为3元,相比空闲时段的DeepSeek-V4-Flash,输入和输出价格均低33.33%。

Qwen3.8-Flash-Next是基于下一代Qwen4架构构建的先导预览版,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数,原生支持262144 token上下文,并可通过YaRN扩展至100万token。千问团队表示,该模型在编程和办公任务上性能更强,且在其基准测试中绝大多数超过DeepSeek-V4-Flash正式版。

在平台接入方面,Qwen3.8-Flash将首发上线“千问办公”,API即将上线。千问AI平台将以qwen3.8-flash的名称提供服务,支持兼容OpenAI的Chat Completions和Responses API,以及兼容Anthropic的接口,可直接配合Claude Code、Codex使用。

千问团队透露,提前释出结构上的改动,是为了在发布Qwen4完整模型家族之前,先让社区对其进行检验。目前,Qwen3.8-Flash-Next的模型权重已在Hugging Face与ModelScope发布。

来源
  1. 2026-08-27 12:51 | IT之家:阿里云:下调百炼平台 Qwen3.8-Flash 大模型计费单价
    阅读原文

    感谢IT之家网友 麻辣清补凉 的线索投递! IT之家 8 月 27 日消息,阿里云公告,大模型服务平台百炼将于北京时间 2026 年 8 月 27 日 12:00:00 起,对 Qwen3.8-Flash 模型模式计费单价进行下调调整。具体如下:计费项调整前调整后输入¥1.00¥0.80输出¥3.00¥2.70据IT之家了解,Qwen3.8-Flash 是千问最新推出的多模态大模型,原生支持百万级上下文窗口,可一次性处理超长文档、代码仓库与复杂对话,在编程辅助、智能体协作、图文理解等场景中表现突出,兼容 OpenAI 与 Anthropic 接口协议,适合构建高并发应用...

  2. 2026-08-26 17:42 | 36氪:千问智谱连夜开源,都比DeepSeek便宜,国产大模型价格猛卷
    阅读原文

    智东西8月27日报道,昨晚,阿里千问大模型团队开源多模态MoE模型Qwen3.8-Flash-Next,该模型是基于下一代Qwen4架构构建的先导预览版。 Qwen3.8-Flash-Next主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数,原生支持262144 token上下文,并可通过YaRN扩展至1百万token。 相比于Qwen3.7-Plus,Qwen3.8-Flash-Next降低了训练与推理成本,训练开销仅约为前者的1/9,但在编程和办公任务上性能更强,且该模型在千问团队放出的基准测试中绝大多数都超过DeepSeek-V4...

其他新闻

查看全部