🎯 AI · 云计算
一、Qwen3-VL-Rerank降价,文本和多模态输入统一至0.5元🔥 阿里云继Flash降价后又砍Qwen3-VL-Rerank,多模态输入价格腰斩再腰斩
9月1日,阿里云公告宣布,大模型服务平台百炼对北京地域Qwen3-VL-Rerank模型计费单价进行下调:文本输入从0.7元/百万tokens降至0.5元,降幅约29%;多模态输入从1.8元/百万tokens暴降至0.5元,降幅高达72%。
这不是阿里云第一次降价。8月27日,百炼平台刚刚下调了Qwen3.8-Flash模型的计费单价。连续两次降价,显示出阿里云在AI大模型服务价格战中的激进策略。
二、全球AI模型价格战全面升级阿里云的降价并非孤立事件。近期,多家海外大模型巨头也相继宣布降价:OpenAI某旗舰模型价格下调20%以上,输出价格降至每百万tokens 20美元;谷歌发布Gemini 3.7 Flash时,以前代模型一半的价格作为首发价;Anthropic则取消涨价计划,将首发优惠价定为永久执行价格。
咨询机构"企业DNA"研究报告指出,这波美国企业AI模型降价速度之快颇不寻常,半年前还大搞高端溢价,如今更像是普通大宗商品的基础设施竞赛。
三、开源模型倒逼闭源模型降价分析人士认为,开源模型正对各大美国企业的闭源模型发起强力挑战。中国开放权重模型的快速进步——如月之暗面Kimi、智谱GLM等——正在改变全球AI定价格局。当开源模型能在本地部署且成本趋近于零时,闭源模型的溢价空间自然被压缩。
AI大模型正在从"奢侈品"变成"水电煤",降价的尽头是规模化应用。
综合证券时报、界面新闻、央视财经报道 | 2026年9月2日