B站今天端出了一塊大模型擂臺——"AI 無限競技場"測評榜,並同步亮出首輪排行榜。在10位 UP 主的真機實測裏,GPT-6Astra 拿下榜首、並且搶下"登頂次數冠軍",把 GLM-5.3壓在身後;前五名裏國產大模型佔了三席,和海外巨頭貼身肉搏。

ScreenShot_2026-09-20_141201_653.png

這塊競技場和傳統跑分榜的玩法不一樣。它把 B站 各領域 UP 主對上百個大模型的真實場景實測匯成一個廣場,涵蓋代碼、推理、協作、知識等多種主題,而且不設固定的測評維度限制——來自不同分區的創作者拿真實工作流、專業應用乃至趣味腦洞自主命題,讓模型在同題 PK 裏把實際差距攤開給人看。DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千問、Hy、MiniMax 等主流模型都在對比之列,排名實時刷新,並持續向全站 UP 主開放報名。

B站 押注這塊榜單,底氣來自平臺上 AI 內容的爆發。過去一年,B站 AI 知識內容消費時長同比增長72%,月均觀看 AI 內容的用戶超過1.9億,圍繞模型發佈、討論、測評、使用、求助、共建的內容已經成體系。當模型迭代快到跑分榜追不過發佈節奏,把評測權交還給真實創作者和真實工作流,反而更貼近用戶心裏那句"到底哪個好用"——B站 想做的,是把自家的社區生態變成大模型走向大衆的另類裁判臺。