B站上线AI无限竞技场,GPT-6 Astra登顶首期百大模型榜单
2026/09/16 14:23阅读量 3
9月16日,B站「AI无限竞技场」正式上线并公布首期大模型测评榜单。该竞技场汇集各领域UP主对上百个大模型的真实场景实测,不设固定维度限制,旨在通过同题PK直观呈现模型差异。首期榜单中,GPT-6 Astra在10个UP主测评中拿下榜首,国产模型占据前五名中的三席。
事件概述
9月16日,哔哩哔哩(B站)正式推出「AI无限竞技场」,同步发布首期大模型测评榜单。该平台旨在整合社区内由UP主主导的AI大模型真实场景测试内容,为用户提供更全面的模型能力视角。
核心信息
- 榜单结果:在首期发布的榜单中,GPT-6 Astra 在10位UP主的测评中表现最佳,获得榜首;其击败了 GLM-5.3,后者获得“榜首次数冠军”。前五名中,国产大模型占据三个席位。
- 测评机制:与传统跑分评测不同,「AI无限竞技场」不设主题或测评维度的硬性限制。来自B站各分区的UP主基于真实工作流、专业应用及趣味脑洞等自主命题,涵盖代码、推理、协作、知识等多种主题,进行同题PK。
- 覆盖范围:首期榜单已包含 DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax 等主流模型的对比测评。
- 生态背景:过去一年,B站AI生态显著增长,AI知识内容消费时长同比增长72%,月均观看AI内容的用户超过1.9亿。活跃的社区氛围促进了大量多维度测评内容的沉淀。
值得关注
- 实时更新与开放报名:竞技场排名将实时更新,并持续面向全站UP主开放报名,随着更多真实场景样本的加入,模型能力的检验将更加充分。
- 榜单链接:https://www.bilibili.com/blackboard/era/aiarena.html
