🎯 科技 · AI大模型

🔥 270亿参数本地模型碾压2840亿云端模型,中国AI从"参数军备"转向"效率决胜"

一、小模型逆袭万亿旗舰,国家级测评出炉

近日,工信部中国信息通信研究院公布了一份震撼业界的检验报告:上海原点星辉科学技术有限公司(StartLux)自主研发的本地大模型StartLux-V1.0-27B-Preview,在可信AI大模型基准测试——MCP专项测试中,以仅270亿参数的体量,综合性能位列第二,多项智能体任务排名第一。这一成绩大幅超越了2840亿参数的DeepSeek-V4-Flash和1980亿参数的Step-3.7-Flash,以不到1个百分点的差距紧追1.6万亿参数的DeepSeek-V4-Pro

这次测评由信通院人工智能研究所主导,涵盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D设计等6类专项任务,重点考察模型在真实工作场景中的工具调用、多步规划和任务完成能力。测试结果显示,StartLux-27B在位置导航任务中独占第一,浏览器自动化、金融分析等核心实操任务中也与万亿参数旗舰模型并列第一或独占榜首。

二、本地模型崛起,数据隐私成核心竞争力

与云端大模型不同,本地模型将AI推理能力直接部署在用户个人设备上,数据无需上传云端,隐私保护、成本控制和离线运行成为其三大核心优势。StartLux CTO郭权玮博士表示,该模型可在消费级个人电脑上流畅运行,普通消费者无需昂贵专业设备即可使用具备较强能力的AI。

这一突破具有深远意义。过去几年,大模型行业陷入"参数越大越强"的军备竞赛,但当基础模型能力跨过实用门槛后,用户和企业的真实困扰从来不是测试分数与排名,而是数据是否安全、隐私是否可控、长期使用成本是否可接受。本地模型正好切中了这些痛点,让AI从"云端巨兽"走向"桌面精灵"。

三、中国AI双线领跑,从跟随到输出标准

事实上,中国大模型正在实现云端与本地双线领跑。云端模型方面,全球最大开源AI模型平台2026年春季报告显示,中国研发的开源模型下载量已占全球总量的41%,超越美国位居世界第一,累计下载量突破100亿次;在全球主流大模型调用榜单上,排名前六位的模型全部来自中国团队。

而如今,StartLux本地大模型为中国AI竞争力再添新的有生力量。业内认为,大模型产业正从技术能力展示转向应用价值验证,StartLux-V1.0-27B-Preview的测试结果为这一趋势提供了产业侧验证。该模型以Qwen3.6-27B为基座做后训练定向增强,采用AI训练AI(Auto Research)的前沿方法,是国内首个采用该方法进行后训练的本地Agent模型。

综合新华网、上观新闻、36氪报道 | 2026年9月1日