登录

阿里开源Qwen 3.8-Flash,性能超Opus 4.6价格仅为其3%


速读:Qwen3.8-Flash今晚将首发上线“千问办公”,开发者和企业也可通过千问AI平台获取新模型API服务。 得益于架构和训练的革新,Qwen3.8-Flash训练成本较Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。
2026年08月26日 20:49

  新浪科技讯 8月26日晚间消息,阿里发布并同步开源千问最新模型 Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿(6B)即可获得超越Claude Opus4.6的前沿性能,创下模型效率全球新基准。

  得益于架构和训练的革新,Qwen3.8-Flash训练成本较Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。Qwen3.8-Flash今晚将首发上线“千问办公”,开发者和企业也可通过千问AI平台获取新模型API服务。

  Qwen3.8-Flash是一个多模态混合专家(MoE)模型,采用了下一代(Next)模型架构,Transformer参数125B仅激活6B,性能表现超越Opus4.6、接近Opus4.8。仅完成预训练的Qwen3.8-Flash基座(Base)模型,在通用(SuperGPQA)、数学推理(GSM8K)、编程(SWEBench-Pretrain)等基础能力上超过了3倍其大小的Qwen3.7-Plus基座模型。经后训练后,Qwen3.8-Flash性能实现跃迁:在考验智能体编程的SWE-bench Pro评测中领先Opus4.6多达9.1分;在长程专业任务CoWorkBench、真实工具调用Toolathlon Verified等智能体任务中均超越了DeepSeek-V4-Flash。

  Qwen3.8系列技术创新,带来了训练和推理的成本大幅下降。Qwen3.8-Flash性能与上一代Qwen3.7-Plus接近,但仅用九分之一的资源便完成了训练,训练成本降90%;推理时,Qwen3.8-Flash每百万Tokens输入低至1元,输出3元,是Claude Opus4.6的3%,是DeepSeek-V4-Flash闲时价格的2/3、忙时价格的1/3。(文猛)

主题:Qwen3.8-Flash|训练|推理|DeepSeek-V4-Flash|Qwen3.8-Flash性能