阿里发布Qwen3.8-Flash-Next多模态模型,采用混合专家(MoE)架构,每次任务只激活部分模型参数。这种设计在保持高性能的同时大幅降低计算资源消耗,代表AI效率优化的新方向。AI算力成本下降意味着更多机构能够负担起顶级模型,推动AI普惠化进程。