Qwen3.8-Flash 开源:以稀疏激活追求更高性价比
阿里千问发布多模态 MoE 模型 Qwen3.8-Flash,通过较小激活参数量控制计算成本,并计划提供云端 API 服务。
阿里千问发布并开源 Qwen3.8-Flash。模型采用多模态 MoE 路线,在较大总参数规模下,每个 Token 只激活其中一部分参数,以平衡能力与计算成本。面向开发者的低价 API 和开源权重,将进一步推动模型在实际产品中的试验与部署。
阿里千问发布多模态 MoE 模型 Qwen3.8-Flash,通过较小激活参数量控制计算成本,并计划提供云端 API 服务。
阿里千问发布并开源 Qwen3.8-Flash。模型采用多模态 MoE 路线,在较大总参数规模下,每个 Token 只激活其中一部分参数,以平衡能力与计算成本。面向开发者的低价 API 和开源权重,将进一步推动模型在实际产品中的试验与部署。
文章回复
0 条公开回复