🎯 科技 · AI
一、降价公告:从0.7元到0.5元,文本输入直降28.6%🔥 阿里云把Qwen3-VL-Rerank文本输入价砍到0.5元/百万token,AI推理成本再创新低
8月31日,阿里云在官方平台发布公告,宣布大模型服务平台百炼对北京地域的Qwen3-VL-Rerank模型计费单价进行大幅下调。此次调整的核心在于,文本输入价格从原来的0.7元/百万tokens降至0.5元/百万tokens,降幅达28.6%;多模态输入价格同样从1.8元/百万tokens降至0.5元/百万tokens,降幅更为惊人。
这意味着,对于大量依赖文本检索和排序(Rerank)的企业级用户而言,调用成本将直接下降近三成,对大规模文档检索、搜索引擎优化等应用场景的成本控制意义重大。
二、市场背景:中国AI模型用量爆发,云端进入新一轮上行周期据美银美林最新发布的中国AI模型月度监测报告,8月份模型快速升级、算力需求趋紧、云端资本开支大幅攀升三条主线同步演进。腾讯与阿里巴巴二季度资本开支分别达到人民币530亿元和680亿元,云收入增速亦显著提速——阿里巴巴云收入同比增长达到45%,为近年来最高增速。
在模型用量方面,OpenRouter数据显示,DeepSeek V4 Flash当月累计达31.6万亿tokens位居首位,腾讯Hy3以26.2万亿tokens紧随其后。中国AI模型市场正从单纯的模型竞争向商业变现加速跃迁,云端基础设施的扩张成为必然趋势。
三、价格战与竞争力:国产大模型降价潮背后的战略逻辑阿里云此次降价并非孤例,而是国产大模型"价格战"的又一环。过去半年内,多家国产大模型厂商相继下调推理价格,旨在以更低门槛换取更大市场份额和用户粘性。对阿里云而言,通过降价抢占企业级AI服务市场,既是应对市场竞争的务实之举,也是推动Qwen系列模型生态繁荣的关键一步。
分析人士指出,随着Qwen3-VL-Rerank模型能力持续提升,叠加价格下探,将进一步降低中国企业部署AI应用的技术门槛,推动大模型从"奢侈品"变为"日用品",加速AI产业化落地进程。
综合证券时报、华尔街见闻报道 | 2026年9月1日