vivo蓝心冲上榜首 手机端侧大模型第一 分数逼近云端

SuperCLUE刚放出的OnDevice手机端侧大模型榜单,直接把vivo蓝心BlueLM 3.5 Nano 3B推到了综合排名第一的位置。这分数,离那些主流云端大模型已经非常近了。说白了,现在在手机上本地跑的AI,水平真不差。

这次测评专门盯着能直接在手机本地运行的端侧大模型。云端模型只拿来当参照物,不参与最终排名。跑分数据显示,vivo蓝心BlueLM 3.5 Nano 3B拿到了89.86分。这个数字,放在整个行业里看,含金量相当足。

为了让大家心里有底,对比的云端模型分数都挺高。谷歌Gemini 3.6 Flash是93.64分,豆包Doubao Seed 2.1 pro拿到92.99分,千问Qwen3.8 Max得分92.25分。

这么一对比,vivo这款3B参数的手机本地模型,跟顶尖云端模型的分差已经缩得很小了。 再看端侧榜单的其他选手,第二名是Qwen3.5 9B,得分87.82分。第三名Qwen3.5 4B拿到85.16分。

剩下的参赛选手还有GLM 4.6V Flash (9B)、Gemma 4 E4B it、Gemma 4 E2B it,分数依次往下排。整体来看,端侧模型的竞争也挺激烈。 端侧大模型最大的好处,就是不用全程连着网。

手机本地就能完成推理,处理图片和文本任务时,不会把用户的输入内容传出去,隐私保护这块会更让人放心。这也是为什么越来越多厂商开始重视本地AI的原因。 不过缺点也摆在那儿,受手机硬件限制,参数规模没法做得太大。

以前大家普遍觉得,本地模型的效果肯定比云端版本差一大截。现在看,vivo这次3B小参数模型跑出这个成绩,说明小体积端侧模型,也能把能力做上去,不一定非要靠堆高参数来撑场面。 当然了,3B模型跟十几B、几十B的大模型比起来,在处理特别复杂的任务时,还是会有能力上限。

这不是技术不行,而是物理条件决定的平衡点。对普通用户来说,端侧AI的体验会越来越重要。以后手机AI功能不用完全依赖网络,断网环境也能正常用,隐私风险自然也就降下来了。 得提醒一句,单次测评只代表基准测试的表现。

实际日常用起来怎么样,还得看手机厂商在系统层面的调优功夫。这事儿,光看分数还不够,真机体验才是硬道理。

热门推荐