🎯 科技 · AI
一、价格战打到地板:0.025元的极限博弈🔥 Token降价99%却换不来盈利,AI行业正从"烧钱换规模"迈入"洗牌定生死"的新阶段
2026年AI圈最醒目的数字不是参数量,而是Token价格。DeepSeek V4-Pro的输入缓存命中价已降至每百万Token 0.025元,小米MiMo-V2.5系列最高降幅达99%,国内同等智力水平模型的每百万Token推理成本三年降幅超99.7%。价格战打到地板,但地板下面还有地下室。更夸张的是,国内日均Token调用量从2024年初的1000亿飙升至2026年3月的140万亿,增幅超千倍;截至2026年6月进一步突破500万亿。单价跌了九成以上,调用量翻了上千倍,企业AI总支出反而从450万美元攀升至1160万美元,呈现"单价跌、用量涨、总账单飙升"的结构性矛盾。
这背后是一场残酷的生态争夺战。国产头部模型几乎全部开放权重,闭源厂商的溢价空间被系统性挤压。但OpenAI总裁Brockman在GPT-6 Astra发布时撂下一句——"未来比较的单位应该是每任务成本,不是Token单价",标志着竞争维度正在升级。
二、增收不增利:厂商盈利困局硅基流动是中国最大独立Token工厂,2025年营收5533万元,净亏损3.45亿元,每挣1元亏6元,公有云业务每获1元收入亏损至少1.19元。DeepSeek虽曝出今年前7个月营收达去年全年10倍、API毛利率亮眼,但算力与芯片巨额投入仍是大山。Anthropic虽实现利润转正,但75%-85%收入依赖云平台市场,每笔交易被高额抽成。低价换规模的路上,几乎所有厂商都在烧钱,没有一个是赢家。
转机出现在2026年8月——DeepSeek宣布全面上调API定价,智谱GLM-5在Q1连续涨价,全季涨幅达83%,月之暗面Kimi K2.6输入价格从0.6美元涨至0.95美元。定价分化信号明确:行业刚走到从"烧钱换规模"转向"可持续盈利"的临界点。
三、分化与洗牌:谁能活下来?国产大模型定价路线已泾渭分明。降价派(DeepSeek、小米)依靠MoE架构——推理时仅激活部分参数,算力消耗下降超70%——以极致低价抢占开发者生态。涨价派(智谱、Kimi、MiniMax)则凭借B端黏性与技术壁垒维持溢价,转向"模型+算力+运维"综合方案。豆包则在C端推出68/200/500元三档订阅,日活1.4亿用户中筛选1%高价值用户即可支撑商业模式。
Token跌破1美元不是算力的终点,而是行业洗牌的起点。低端低价模型持续内卷却无人问津,高端稳定高吞吐的算力资源却一票难求。2026年的残酷真相是:能活下来的,从来不是最便宜的,而是最稳、最高效、最会运营算力的玩家。
综合新浪财经、华尔街见闻、搜狐科技报道 | 2026年9月6日