🎯 科技 · 大模型价格战

🔥 阿里云Qwen3-VL-Rerank多模态输入价格从1.8元暴降至0.5元,国产大模型价格战与全球趋势同频共振

9月1日,阿里云公告宣布:大模型服务平台百炼对北京地域Qwen3-VL-Rerank模型计费单价进行大幅下调——文本输入从0.7元/百万tokens降至0.5元,多模态输入从1.8元/百万tokens直接砍到0.5元,多模态输入价格一次性下降了72%

这不是阿里云首次降价。早在8月27日,阿里云就宣布下调Qwen3.8-Flash模型价格。短短一周内连续两次降价,释放的信号再明确不过:国产大模型的价格战已经全面打响

一、全球大模型价格战:从高端溢价到基础设施竞赛

阿里云的降价并非孤立事件,而是全球大模型定价策略转向的一个缩影。近期,多家海外AI巨头也相继宣布降价:OpenAI将其某款大模型价格下调20%以上,输出价格降至每百万tokens 20美元;谷歌发布Gemini 3.7 Flash时,以前代模型一半的价格作为首发价;Anthropic则取消原定涨价计划,将首发优惠价定为永久执行价格。

咨询机构"企业DNA"的研究指出,这波降价速度之快颇不寻常。仅仅在半年以前,前沿大模型还大搞高端溢价,如今更像是普通大宗商品的基建竞赛。模型定价正在从"技术稀缺性定价"转向"规模效应定价"——谁能在保证质量的前提下把价格打下来,谁就能获得更大的用户基数和生态壁垒。

二、降价背后的账:量价博弈与国产芯片突围

降价对云厂商意味着什么?国泰君安期货的分析指出,降价有利于扩大智能体和推理调用,但单位Token收入会下降,云厂商需要依靠调用量增长和推理效率提升来维持算力回报。这是一个典型的"薄利多销"逻辑。

但对用户和企业来说,降价的直接意义是:AI应用的门槛正在被大幅拉低。多模态输入价格从1.8元降至0.5元,意味着基于视觉理解的业务场景(如文档识别、图像搜索、内容审核)的调用成本可以直接砍掉一大半。

更深层的意义在于国产AI生态的自强。当前,DeepSeek V4、GLM-5.3等国产主流模型已实现与多家国产芯片的Day0深度适配,软硬协同闭环加速形成。智谱披露,已实现10万级国产芯片规模化推理,单位Token推理成本较年初下降80%。国产模型+国产芯片的双重降价,正在构建一条独立于海外技术的AI基础设施供应链。

三、价格战之外:国产大模型的差异化竞争

虽然价格战是当下的主旋律,但国产大模型厂商也在寻找差异化竞争路径。阿里云在降价的同时,也在持续拓展Qwen模型的应用场景——千问学习功能升级,新增与教材同步的单元作文辅导、初中语文数学教材精讲,并扩展高中、大学数理化拍题讲解能力,相关功能均免费开放。

智谱方面,GLM-6.0正在瞄准"自进化"方向推进,下一代基座模型已处于研发中。面对市场关于"只会后训练"的质疑,智谱创始人唐杰明确表示,下一代模型会继续扩大基座规模,同时管控激活参数以避免推理速度下滑和成本上升。

工信部也在此时发布了关于开展人工智能应用服务商培育专项行动的通知,探索通过首购首用、风险补偿等模式,加大大模型、智能体、Token等服务采购力度。政策端与产业端的双向发力,正在为国产大模型的价格战提供制度保障和市场空间。

价格战不会永远持续,但它正在发生的意义不容忽视:当AI模型的调用成本降到足够低,才能真正进入千行百业的日常 workflow,从"科技公司的玩具"变成"企业的生产力工具"。这场由阿里云发起的价格战,也许正是中国AI从"能用"走向"好用"的关键一步。

综合证券时报、界面新闻、央视财经报道 | 2026年9月2日