AI行业长期信奉一条铁律:参数越大,模型越强。万亿参数旗舰模型被认为是能力天花板,百亿级模型只能仰望。然而,2026年8月中国信通院的可信AI大模型基准MCP专项测评,彻底颠覆了这个认知。
上海原点星辉科学技术有限公司自主研发的StartLux-V1.0-27B-Preview模型,以仅27B的轻量化参数量,在综合测评中斩获39.25%得分,位列全国第二。它的表现有多夸张?大幅超越284B的DeepSeek-V4-Flash、198B的Step-3.7-Flash等主流云端大模型,仅落后1.6万亿参数的DeepSeek-V4-Pro约1.3个百分点。
更值得注意的是,该模型在位置导航任务中拿下全国第一,浏览器自动化、金融分析等核心实操任务并列或独占榜首。作为国内首个采用"AI训练AI"(Auto Research)后训练技术的本地Agent模型,StartLux 27B证明:通过精准的场景化训练和AI自训练技术,小参数模型完全可以在实际应用中实现越级挑战。
业内分析指出,这标志着AI行业从"参数军备竞赛"转向"实战能力比拼"的新阶段。模型能力的衡量标准,正从实验室跑分延伸到真实任务执行。对于企业而言,这意味着更低部署成本、更快推理速度、更高落地效率的本地化AI解决方案时代正在到来。
小小参数,大大逆袭。当27B的上海本地模型站上全国第二的领奖台,AI行业的"唯参数论"正式翻篇。
AI 生成 . agnes-2.0-flash | 搜索综合