🤖 科技 · 算力经济
一、词元商店上线,算力像买流量一样用🔥 AI算力从"建了就有人用"的粗放扩张,正式迈入Token计量、弹性调度的精细化运营时代
2026年服贸会上,中国电信把三款词元套餐摆上了展台。工作人员一句话说透了:#中国AI把推理成本砍到近乎零#——用户像购买流量一样购买词元,用多少扣多少,不同模型价格不同。背后是一个开放的模型聚合平台,主流大模型全部接入,还能提前试用。中国移动同步推出算力交易运营平台,统一完成合规审核、算力调度和费用结算,按词元消耗量计费。
这意味着算力不再是"建了就有人用"的静态资产。商汤科技联合创始人杨帆算了一笔账:一台AI服务器按五年折旧,期间AI下游需求可能经历12轮迭代,一个模型最高价值的窗口期只有3个月,能卖出高价钱的时间只有一个月。硬件端压力更不容忽视——近3个月,国产GPU涨价超过30%。
二、推理主导时代,供需缺口持续拉大中国信通院数据显示,2026年一季度国内AI算力需求同比增长417%,有效供给增速仅128%,供需缺口持续拉大。中信建投研报指出,AI算力全面迈入"推理主导"的新周期,应用端高Token密度场景爆发驱动需求激增,供给端呈现高端持续紧缺、中低端趋于结构性饱和的分化格局。
算力租赁市场正加速爬坡。中国信通院预测,2026年算力租赁市场规模有望突破2600亿元。商业模式正由裸金属租赁向Token分成与Token工厂一体化服务升级,叠加锁长单与金融杠杆赋能,全面重塑产业确定性。中国联通则全面开放"Agent+Token+AI云"运营体系,将算力供给、模型调用和场景回报算成"一本账"。
三、弹性调度破局,资源利用率提升7倍上海交通大学可扩展计算研究所所长戚正伟在论坛上一语道破痛点:"一边大家排着队等机器用,一边机器空在那里没人用。"他的解决方法是弹性调度——把一张GPU卡切成多张虚拟卡动态分配,空闲时自动占满,有人用时自动让出。实验数据显示,仅靠弹性调度,性能和资源利用率最高可提升7倍。
沐曦股份创始人陈维良则指出,目光不能仅聚焦GPU单卡性能,更要算TCO(总拥有成本)的经济账。降低隐性成本的底层逻辑是通用性和生态开放性。从"建算力"到"供Token",算力产业正站在从规模扩张到效率革命的拐点上。
综合证券日报、每日经济新闻、21世纪经济报道 | 2026年9月11日