8月27日,千问大模型宣布Qwen3.8-Flash正式发布。
Qwen3.8-Flash是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。原生支持262144 token上下文,并可通过YaRN扩展至1M token。
据了解,Qwen3.8-Flash围绕Attention、Residual、Embedding、Optimization四个方面对模型进行了系统升级。相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本。
Qwen3.8-Flash现已上线千问AI平台,对外提供API服务,每百万Tokens输入1元,输出3元。Qwen3.8-Flash还将首发上线“千问办公”。