9月16日,星期三
1 小时前
B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首

9月16日,B站「AI无限竞技场」正式上线,首期大模型测评榜单同步公布。GPT-6 Astra在10个UP主测评中拿下榜首,打败GLM-5.3获得榜首次数冠军;前五名中,国产大模型占据三席。

 

「AI无限竞技场」是一个汇集了B站UP主AI大模型测评的竞技广场,由各领域UP主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。

 

 

不同于传统跑分评测,B站AI无限竞技场不设主题或测评维度限制,来自各个分区的UP主们以真实工作流、专业应用、趣味脑洞等自主命题,在同题PK中直观呈现各模型的实际表现差异。首期榜单现已涵盖DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax…等主流模型对比测评。

 

过去一年,B站AI生态迎来爆发式增长。AI知识内容消费时长同比增长72%,月均观看AI内容的用户超过1.9亿。AI大模型或产品应用,从发布到用户讨论、测评、使用、求助、共建,B站的直播、视频、弹幕天然适配AI科技爱好者们的信息获取和交流需求,活跃生态下,大模型测评也在B站社区沉淀,涌现出大量各个领域、维度、主题的测评内容。「AI无限竞技场」这一测评集合广场顺势而生。

 

竞技场排名将会实时更新,并持续面向全站UP主开放报名。

 

随着更多测评案例加入,这些来自真实场景的样本测试,将让模型能力得到更充分检验,也为用户了解AI能力边界提供更全面的内容视角。

 

榜单链接:https://www.bilibili.com/blackboard/era/aiarena.html?bsource=market_aiarena_sns_02

[展开]
加载更多