中美大模型差距拉大:美国三巨头狂飙 国产AI期待梁圣归来

全球AI竞赛的核心战场在中美两国,近期高频使用AI的用户可能已经察觉到一个残酷现实:双方的差距正在扩大,而非像此前那样逐渐拉近。这并非危言耸听,而是基于实际体验得出的结论。

美国AI领域的三大巨头近期动作频频,高强度更新成为常态。以Anthropic为例,早前因Opus 4.7至5.0版本性能提升不及预期而饱受嘲讽。然而,随着Fabel 5.1到Opus 5.5、Sonnet 5.5这波更新的推出,局面瞬间反转,用户量和口碑双双回升。尽管针对国内用户的封号力度也在加强,但这丝毫阻挡不住国内开发者重金购买Opus 5.5的热情,其底气足以支撑高昂的成本。

OpenAI方面同样不甘落后,密集发布了GPT-6系列的多个大模型,涵盖Astra、Sol等旗舰级产品。这些产品的表现可谓好坏参半,特别是GPT-6 Sol在上线不到一周后便被6.1 Sol取代,迭代速度之快令人咋舌。整体实力依然强劲,但引发用户不满的主要在于其运营策略,尤其是200美元套餐的调整问题,引发了不少争议。

谷歌今年的表现则显得有些扑朔迷离。过去几个月里,其主要依靠Flash模型来维持市场存在感。不过,最新的Gemini 4.0 Argon带来了一波咸鱼翻身的机会。目前该模型虽限制了使用范围,但性能表现相当出色,有望正式重返第一梯队,与另外两家并肩作战。

与之形成鲜明对比的是,近几个月来国产AI大模型显得格外低调。这并非因为他们停止了产品更新,而是缺乏能够惊艳市场的爆款产品,风头完全被美国AI三巨头所掩盖。整个行业陷入了一种沉默的焦虑之中。

具体来看各家进展,Kimi发布的K3距今已有两个多月,期间虽然升级了K2.8版本,但备受期待的K3.1至今毫无动静。智谱的情况类似,在GLM-5.3之后推出了GLM-5.3 Flash模型,但旗舰级产品同样超过两个月未进行重大升级,用户耐心正在消磨殆尽。

最受瞩目的当属DeepSeek,自4月底发布V4.0系列以来,过程颇为曲折。V4 Pro正式版未能达到市场预期,加之价格大幅上涨,导致口碑急剧下滑。直到9月份,凭借V4.1 Flash版本的推出,才勉强挽回了一些品牌形象,但信任重建仍需时日。

其他国产AI公司方面,小米发布了Mimo-V2.6系列大模型,发布初期通过刷榜制造了不少声量。然而好景不长,没过几天,热度迅速消退,还曝出了一系列问题,让外界对其稳定性产生质疑。营销效果未能转化为持久的用户认可。

MiniMax的M3.1同样处境尴尬,几乎没有什么市场存在感,性能上也乏善可陈。倒是其视频大模型H3在国内外颇受欢迎,主要原因在于本地部署的巨大吸引力,满足了用户对数据隐私和低成本运行的需求。

除了产品本身的竞争力问题,这几家国产AI公司近期还面临诸多非技术层面的麻烦。例如上传用户代码引发的争议,这虽不属于纯技术范畴,却直接关系到企业的生存根基和用户信任度,处理不当将造成深远影响。

回溯历史,国产AI与美国的差距究竟是从何时开始拉大的?4月份Mythos大模型的发布被视为一个重要转折点,当时并未对外开放。直到6月至7月,Mythos和Fable陆续向公众开放,双方实力的鸿沟才真正显现出来,差距随之加剧。

对于国产AI而言,当前面临的挑战不仅是旗舰级大模型与美国巨头的性能落差,还包括算力短缺引发的连锁反应。API价格上涨、Token计划限售等问题接踵而至。与此同时,Anthropic和OpenAI近期多次降价并提供优惠,使得国产AI在性价比优势上也不占上风,当前的竞争底线或许已提升至GPT-6.1或Sonnet 5.5的水平。

不过,目前的差距扩大态势仅是暂时现象,国产AI无需因此陷入绝望。一方面,算力不足的困境正在逐步改善。智谱和DeepSeek均公布了利用国产芯片开展推理业务的积极进展,其中DeepSeek更是重构了一套可与NVIDIA CUDA相媲美的软件生态系统,基础架构自主可控性增强。

另一方面,多家公司的新一代大模型已蓄势待发,处于箭在弦上的状态。Kimi K3.1、GLM-5.5以及DeepSeek V4.1 Pro的测试消息相继传出,最快可能在国庆假期结束后陆续亮相。业界普遍期待能见证“梁圣归来”般的辉煌时刻,重现昔日荣光。

智谱创始人唐杰此前在回应马斯克评价时曾指出,国产AI不必等到明年才能追赶上Mythos级别的性能水准。鉴于今年仅剩两个多月的时间,他期望能尽快看到国产AI迎来新一轮的爆发式增长,扭转当前的被动局面。

热门推荐