距离发布不到1天:DeepSeek V4正式版能力堪比核弹
明天就是20号了,这一天对普通人来说平平无奇,可对DeepSeek而言意义非凡。官方早已定调,7月中旬要推V4正式版,现在只剩最后一天。 AI圈最近最热的新闻是Kimi K3发布,这款2.8万亿参数的大模型,是国内之最,也是开源界规模最大。
GPT-5.6和Fable 5这些美国顶级模型的参数量没公开,马斯克之前说过5到10万亿,但业内合理推测是3到5万亿。 正因如此,无论是K3还是那俩美国巨头,价格都不低。K3大概是后者的三分之一到一半,用得多了照样心疼钱包。
这时候DeepSeek V4正式版就更让人期待了。虽说官方明确高峰期会翻倍涨价,但整体价格依旧便宜不少。 更香的是缓存命中率超高,API不用办套餐,用多少买多少。 网上有份各家大模型API价格的汇总,V4的价格差不多是另外两家的三十分之一到七十分之一,平均算下来便宜四五十倍真不是吹牛。

比起价格,V4正式版的能力才是大家最关心的。之前的预览版虽被认为是开源领域综合第一,但编程能力不算顶尖,官方自评也就接近Opus 4.6。 可这三个月里,国内外AI都更新了一轮。 好消息是,泄露的V4正式版测试结果让人眼前一亮。
测试主要扎堆在B站,内容多为“一句话生成游戏”,这正是Fable 5这类大模型最擅长且公认最强的领域。 看了这么多测试,V4正式版展现出的能力绝对让人咋舌。超过Opus 4.8问题不大,可能略低于Fable 5,毕竟V4在多模态上有缺失,正式版是否支持多模态还没准信儿。
借用AI圈的一个名梗,V4正式版的问世就像原子弹爆炸,梁文锋看到也得整个人发晕,瘫坐椅子上。 当然,这话不能说得那么满。V4正式版泄露的能力太猛,反倒让不少人怀疑其真实性。 一方面,目前灰测渠道多是B站用户,其他渠道也有,但极少。

另一方面,有人猜V4正式版其实是DeepSeek路由到了Fable 5大模型上,所以性能表现其实是后者的。 但这个说法很不合逻辑,DeepSeek的风格也不是这样。造假很容易拆穿,对品牌形象伤害巨大,还捞不着啥好处。
就算梁文锋被封为梁圣,也没必要自己掏一分钱,让大家去用一百块的Fable 5。 再者,很多B站用户的测试都甩出了OpenCode对话链接或全程录像,梁圣拿Fable 5造假这事儿根本说不通。 眼下虽不能完全确认V4正式版性能就这么炸裂,但怀疑造假的念头能解释很多人的心态——觉得美国领先、中国落后是天经地义的。
要是国内企业真做到最强水平,人们第一反应不是庆幸,而是先怀疑是不是在搞假动作。 就像K3这几天在海外遭遇的情况,有人恭喜中国开源AI冲到顶级,但也有不少美国账号明显破防。 他们说K3是蒸馏了Fable 5,抄美国AI的作业,还强调美国公司有底线有道德,不会去蒸馏别家模型。
没错,AMD前企业副总裁就是这种人。