📱 AI终端 · 智能体 · 国家标准
一、一张证书背后的标准革命🔥 L3认证只是AI Agent手机的能力及格线,真正的下半场看的是L4"协同级"何时能填上那张空白的考卷。
2026年7月17日,随着首批人工智能终端智能化分级测试结果公布,手机厂商集体官宣自家产品通过国家L3级认证的场面,成了行业少见的集体预热。华为强调"首证",小米强调"国家级",vivo直接把L3称作当前最高智能化评级。这批名单共11款移动终端达到L3,包括9部手机和2台平板,覆盖华为、荣耀、vivo、OPPO、小米、摩托罗拉和阶跃星辰等品牌。
但很多人误会了这份证书的分量。它对应的GB/Z 177—2026《人工智能终端智能化分级》,其实是一套指导性技术文件,不是决定手机能否上市的强制性国标。它评的是具体型号及其软硬件版本,而不是给整个品牌发段位;首批结果也来自厂商主动送测,并非市场随机抽样。换句话说,L3可以当卖点,但还不是手机行业的总排行榜。
二、L3到底"聪明"在哪想理解L3,得先看懂分级逻辑。标准把终端能力拆成感知、认知、执行、记忆、学习五个维度,从L1响应级、L2工具级到L3辅助级、L4协同级逐级攀升。用一个"帮我安排周末杭州旅行"的场景来说明:L1只能听懂一步指令,像被语音触发的手指;L2能查天气、生成行程,但流程是预先铺好的;而到了L3,手机要能主动追问预算、把任务拆解、筛选酒店、写进日历,把确认权在涉及付款或不可逆操作时交还用户。
测试也远不止一张海报。终端要在至少3个典型场景中接受考试,工具调用任务的成功率不低于80%,单项任务默认5分钟内完成。复杂推理可以放云端,但端侧能力要在离线环境里测。这揭示了关键一点:真正参加考试的不是单个大模型,而是模型、系统、应用、权限机制组成的整支队伍。模型再强,困在聊天框里也成不了L3。
三、L4空着,才是真正的下半场手机厂商爱把L3称作"当前最高等级",这其实是个文字游戏——L3只是目前给出明确测试要求的最高级,而非这套认证的天花板。在标准细则里,L4"协同级"的具体要求直接标注为"待定"。这不暴露模型能力不足,而是暴露了更棘手的问题:多个智能体、多台设备、多个服务主体之间的责任边界与安全机制还没成熟。订票交给旅行智能体、预算交给支付服务,任务出错谁负责?一个Agent拿到的权限能不能转给另一个?
所以对普通用户来说,现在不必为一张证书急着换机——很多L3能力会随系统更新下放现有旗舰。真正的分水岭在于,等标准先回答"什么叫协同、以及协同失败时谁来踩刹车",AI Agent手机才真正进入下半场。
综合极客公园、央广网、人民邮电报报道 | 2026-08-20