🎯 AI · 价格战
一、0.18美元的百万Token,价格战打到什么程度了🔥 国产AI模型百万Token低至0.18美元,价格战倒逼全球云厂商跟进降价,AI应用成本进入白菜价时代
2026年6月,OpenRouter平台开源模型词元处理比例已从1月的34%跃升至65%,超过500家机构从专有模型切换至开源模型。DeepSeek V4 Flash每百万词元输入定价0.09美元、输出0.09美元;智谱GLM-5.3-Flash官方定价仅为旗舰版GLM-5.3的十分之一,限时折扣期间低至二十分之一,仅为Claude Opus 4.8的四十万分之一。价格战的本质,不是亏本赚吆喝,而是算法优化与硬件架构演进带来的真实成本下降——Flash模型通过稀疏激活、混合注意力等工程重构,用18B的推理算力开销维持320B参数量所沉淀的领域知识。
一位国内AI应用创业者算了一笔账:以每百万Token 0.97美元计算,一次复杂的文档分析任务成本已降至几美分量级,这在一年前是不可想象的。价格便宜不是终点,是新应用的起点。
二、企业选型全面回归经济理性,云厂商被迫跟进降价成本重构效应沿产业链自下而上传导,微软在Excel、Outlook中以自研MAI模型替代第三方;旧金山AI创业公司Lindy将全生产环境流量从Anthropic切换至DeepSeek,年省数百万美元且核心用例性能不降反升;加密货币交易所Coinbase将智谱GLM-5.2和月之暗面Kimi K2.7设为工程师默认模型,AI支出压缩近半。2026年7月,亚马逊云科技AWS将GPU管理费最高下调60%;腾讯云为DeepSeek V4推出Agent Plan订阅套餐,折扣低至1.9折;华为云推出模型适配迁移激励计划,鼓励开源模型适配昇腾云。
从科技巨头到初创企业,行业技术选型正从唯性能论转向性能与成本综合权衡,开源低成本模型加速替代闭源高价模型。
三、国产算力成价格战的底气,但国芯训国模仍需产业链协同智谱GLM-5.3-Flash的Ox-Alpha盲测期间,每日100万亿Token的庞大流量完全运行在超过10万张国产AI加速芯片组成的集群之上,吞吐成本压低至传统高端英伟达GPU集群的同等水平。国家数据局数据显示,我国日均Token调用量由2024年初的1000亿增至2026年6月的500万亿。应用量的指数级增长,使算力需求重心由少数集中训练任务逐步转向高频、分散且持续的推理负载。
但赛迪研究院钟新龙提醒:模型能力、国产算力、软件工具和行业应用正在共同加速,但训练框架、芯片算子、通信库和云平台调度任何一环跟不上,都会削弱国产模型的成本优势。开源模型加国产芯片能否形成闭环,最终仍要由适配效率、集群稳定性、利用率和规模订单来验证。
综合21世纪经济报道、钛媒体、数字中国研究院报道 | 2026年9月3日