9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。
最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。
这个大模型的能力也非常可期,说是能处理绝大多数日常任务。
从梁文锋的表态来看,DeepSeek的轻量级模型已经接近完成,只不过具体的发布时间、规格参数还没有详细透露。
在本地部署的轻量级大模型中,阿里的Qwen系列是目前的开源大模型标杆,目前可以本地部署的最热门、最强的应该是Qwen3.8 27B这款大模型,社区的优化改良版非常多,性能都要能Opus 4.6扳手腕了,能够胜任日常任务,甚至代码开发任务也是很OK的。
DeepSeek的大模型目标是普通显卡也能跑,这个普通到底怎么定义还不好说,RTX 5090也是桌面游戏卡,但现在的价位和规格不算普通了。
以DeepSeek的风格,最好能做到4060/5060级别的游戏卡就能跑起来,速度30T/s以上保证可用性,这样的轻量级大模型用于处理普通人的日常任务应该问题不大,也不是每个人都要求代码开发。
【本文来源:快•科技】