AI日报来了。科大讯飞又搞了个大新闻——1.7B的端侧AI大模型,却搞出了100万Token的上下文窗口。小模型也能记住海量信息,直接把AI大模型能力塞进了本地设备。这波操作,有点东西。
9月1日,科大讯飞全资子公司词元星火开源星火X2.5-4B和X2.5-1.7B两款端侧通用大模型,这是端侧AI大模型中唯一原生支持100万Token上下文窗口的AI产品。与此同时,国产端侧AI模型赛道已经杀成一锅粥:Meta刚发30B的Muse Glimmer本地大模型,Google甩出Gemma 4 31B,StartLux 27B也刚过信通院测评排到第二。但科大讯飞偏不走拼参数规模的老路,而是选了个新策略——用最小AI参数换最长上下文,让手机、车载、IoT设备本地就能跑AI大模型处理超长文本,不再靠云端撑场面。
这事儿的本质,是AI大模型能力从云端向物理世界的下沉。OpenAI和Claude还在卷参数规模的时候,中国AI大模型厂商已经开始把AI能力往终端塞了。端侧AI大模型的核心价值从来不是多强,而是多近——数据不出设备、隐私可控、延迟极低。尤其车载AI场景,100万token意味着一辆车可以记住整个驾驶历史、城市地图和每位乘客的偏好,这才是真正能落地的长期记忆AI智能体,而不是每次上车都从零开始。
1.7B参数搞定100万token,讯飞在端侧AI大模型这条路上,又抢跑了一步。
AI 生成 . DeepSeek | 搜索综合