V4 Flash首发就爆,斩杀线实锤:网友直呼性能超预期
赶在7月最后一天,DeepSeek终于亮出底牌,V4正式版来了。不过这次先放出来的是V4 Flash-0731,Pro正式版得等到8月初,还得搭配自家的Harness工具一起登场。 这消息一出,风向立马变了。
之前因为跳票被戏称“梁白开”的网友,瞬间恢复了对梁文锋“梁圣”的尊称。为啥?因为V4 Flash-0731的表现太炸裂,完全超出了大伙的预期。 官方给出的测试数据很有看头,性能直接压过了GLM-5.2。
虽然比起Opus 4.8还稍逊一筹,但在部分测试项目里,居然能紧紧咬住后者,差距微乎其微。 光听官方说不够直观,网友们早就按捺不住,纷纷上手实测。结果基本印证了官方的说法,这份成绩单相当亮眼。要知道,V4 Flash-0731只有284B参数,可性能却比不少千亿级别的万亿大模型还要强,这反差感确实让人惊叹。

如果你还没看懂这波操作,可以参考网友整理的AI性能排行榜数据。有人结合GPT分析和API定价,做了一份详尽的对比图,几乎涵盖了国内外主流大模型。 这张图表逻辑很清晰,横轴代表价格,越低越划算;纵轴代表性能分数,越高越强。
每个模型还细分了不同的思考挡位,方便横向比较。 懒得逐个细看的朋友,可以直接锁定V4 Flash-0731的位置。凡是落在它右下角的模型,要么性能不如它,要么价格比它高,说白了就是被全面超越了。 简单讲,右下角那些国内外的大模型,已经被V4 Flash-0731直接“斩杀”。
能逃过这一劫的,主要分两类情况,各有各的讲究。 第一类是价格比它还便宜的,比如GPT-5.6 Luna的低配版和小米的MiMo-V2.5。其中GPT-5.6 Luna刚降了80%的价格,不然也得掉进斩杀线范围。

小米的大模型之前跟着V4预览版降过价,而且支持多模态,有一定优势。但编程能力跟现在的V4 Flash-0731相比,明显差了一大截,估计小米很快也会推出升级版。 另一类是位于右上角的,那是当前国内外巨头的旗舰主力,像Kimi K3、Fable 5、Opus系列以及GPT-5.6 Sol等。
这些模型想拉开差距,必须把思考挡位调到最高档才行。 综合来看,这张图清楚展示了V4 Flash-0731的能力边界。网友之前说DeepSeek是AI领域的“斩杀线”,这话现在看非常精准。 不管是国内还是国外的同行,性能超过你的,没奖励;但如果连你的性能都追不上,你那低廉的价格就会让你难受。
拼价格等于自杀,不拼价格用户就被抢走了。 而且这只是轻量级的V4 Flash-0731,真正的杀手锏V4 Pro正式版还在路上。考虑到参数量是前者的五倍左右,性能值得期待,说不定能把斩杀线标准再往上提一提。
最后聊聊命名,V4 Flash-0731又回到了去年R1那种带日期后缀的风格。这意味着后续还会持续优化,每隔两三个月提升一次,友商们压力不小啊。