阿里千问正式发布Qwen3.8-Flash
创始人
2026-08-26 20:45:48
0次
8月26日,阿里千问正式发布Qwen3.8-Flash。据介绍,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。它原生支持262,144 token上下文,并可通过YaRN扩展至1M token。相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本,训练开销仅约为前者的1/9,但在编码和办公任务上却具有更强的能力。Qwen3.8-Flash即将上线千问AI平台,对外提供API服务,每百万Tokens输入1元,输出3元。今晚,Qwen3.8-Flash还将首发上线“千问办公”。
阿里千问同时发布了Qwen3.8-Flash-Next的开源权重,Next新架构将是全新一代Qwen4系列模型的雏形。本次提前释出结构上的改动,以便在基于此构建Qwen4完整模型家族之前,先让社区对其进行检验。模型权重将在Hugging Face与ModelScope发布,默认1M上下文并内置官方工具的生产版本,以Qwen3.8-Flash的形式在千问AI平台提供服务。
相关内容