🎯 科技 · AI芯片
一、算力堆砌时代正在终结🔥 国产端侧AI芯片五强各有绝活,5W功耗跑16B大模型已成现实
2026年,中国端侧AI芯片市场规模预计突破8661亿元,端侧AI渗透率超过54%。但一个被忽视的真相是:一台AI服务器交付后,真正被有效利用的算力可能连规格表数字的三成都不到。
在手机、摄像头、汽车等终端设备里,功耗、体积、散热都有刚性限制,端侧不需要"大力出奇迹",需要的是"巧劲"。这正是国产端侧AI芯片厂商正在攻克的难题。
二、五大路线各显神通中星微技术的星光智能五号采用多核异构XPU架构,运行DeepSeek 16B大模型时整体功耗控制在5W以内,内存访问功耗降低约60%,8颗芯片联合部署即可支持671B参数DeepSeek满血版运行,部署成本约为服务器架构的三分之一。其SVAC国标生态已应用于全国30余个城市100多个重大项目。
后摩智能的漫界M50采用存算一体架构,10W功耗下实现160 TOPS单芯片算力,可流畅运行30B至120B参数量级大模型,联想AI主机P7搭载M50后综合算力达190TOPS,离线推理速度达50Tokens/s,获2026年ICDIA"AI芯擎奖"。
地平线、光羽芯辰、寒武纪等企业也从车规级BPU、3D堆叠近存算等不同路线切入,共同构成国产端侧AI芯片的多维竞争格局。
三、性价比之战才刚刚开始中昊芯英CMO黄绪近日表示,AI芯片竞争正从"谁拥有最强算力"转向"谁能提供最低的Token成本"。其新一代"须臾"芯片百万Token推理成本仅为海外GPU的35%至50%,芯模联动优化已实现。
随着大模型厂商纷纷自研推理芯片,端侧AI芯片的性价比优势将进一步凸显。对于智慧安防、智能驾驶、AI PC等场景而言,国产端侧芯片的多样选择正在打破单一技术路线的局限。
综合决策与信息杂志、上海证券报报道 | 2026年9月3日