阿里发布Qwen3.8-Flash-Next模型
阿里巴巴通义千问团队发布Qwen3.8-Flash-Next,这是一款多模态MoE(混合专家)模型,同时也是下一代Qwen4架构的早期预览版。模型总参数量达1250亿,另有510亿N-gram嵌入参数,但每个Token仅激活约60亿参数,以此在保持能力的同时大幅压低推理开销。
定价方面,生产版将很快通过Qwen Cloud API开放,每100万输入Token收费0.16美元、每100万输出Token收费0.47美元,成本效益明显。
来源:Bloomberg

