B站推AI竞技场:百大模型同场比,GPT-6夺首冠
B站今天搞了个大动作,正式上线“AI无限竞技场”大模型测评榜,首轮排行结果也同步揭晓。说白了,这就是一场全球百大模型的实打实较量。 首轮榜单里,GPT-6 Astra在十个UP主的测评中拿下头名,击败了GLM-5.3,成为获得榜首次数最多的选手。

更值得关注的是,前五名中,国产大模型占了三个席位,实力不容小觑。 这个竞技场是个啥?它是B站UP主们的AI大模型比拼广场,由各领域博主对上百个模型做真实场景实测。测评主题五花八门,代码、推理、协作、知识,全都涵盖在内。

跟传统的跑分评测不一样,这里不设主题或维度的条条框框。来自不同分区的UP主,用自己的真实工作流、专业应用,甚至趣味脑洞来自主出题。在同题对抗中,各模型的实际差距一目了然。 榜单上能看到DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax这些主流名字的对比。
排名实时变动,而且一直向全站UP主开放报名通道。 数据也能说明热度。过去一年,B站AI知识的消费时长涨了百分之七十二,每月看AI内容的用户超过一点九亿。平台上冒出了海量测评内容,覆盖了从发布到讨论、使用、求助、共建的全链条。