新功能
2026-09-16
B站「AI 无限竞技场」上线,上百个 AI 模型同题 PK
来源:IT之家
一句话说清
B站把站内 UP 主做的 AI 测评汇成了一张公开榜单,上百个模型按写作、推理、代码这些实际任务同题对比,还会一直更新——以后你纠结「到底用哪个 AI」,先来这张表横着比一眼就行。
发生了什么
9 月 16 日,B站「AI 无限竞技场」正式上线,第一期榜单同时公布。
它不是官方跑分,而是把 B站各个分区 UP 主的真实实测聚到一起:谁用同一批模型写代码、谁拿它们做方案、谁测长文推理,都由 UP 主自己命题,同题 PK。
几个关键点:
- 规模:上百个模型同场,首期已涵盖 DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问等主流模型;
- 维度:代码、推理、协作、知识等多种测评主题,先行榜首是 GPT-6 Astra,前五名里国产模型占了三席;
- 不设限制:不限制测评主题和维度,UP 主可以用真实工作流、专业应用甚至趣味脑洞来命题;
- 会持续更新:排名实时更新,也一直开放 UP 主报名,不是发一次就过期的那种榜单。
背景是 B站 AI 内容本身已经很大:AI 知识内容消费时长同比增长 72%,每月看 AI 内容的用户超过 1.9 亿。测评内容早就散落在各个 UP 主那里,这次只是把它们收拢成了一个入口。
对我有什么用
最直接的好处:省掉「自己一个个注册试」的时间。
以前你想知道「写小红书文案用哪个 AI 好」,只有两条路:自己挨个注册试一遍,或者刷自媒体零散测评被不同结论绕晕。现在有一张中文的、分维度的、还在更新的表可以对照看。
更重要的是它按任务分栏,不是只看一个总冠军。同一个模型可能写文案很稳但写代码一般,看综合分反而会误导你。
我可以怎么做
- 打开 B站,搜索「AI 无限竞技场」,或直接访问榜单页:
https://www.bilibili.com/blackboard/era/aiarena.html
- 别先看总排名,先想清楚你最常做的那件事是什么:
- 写文案、写文章 → 看「写作」那栏
- 算数据、做分析 → 看「推理」那栏
- 做表格、写脚本 → 看「代码」那栏
- 看图识图、做海报 → 看「多模态」那栏
- 在你那一栏里挑排名前三的两个模型,记下名字。
- 拿你自己的真实需求去试:把你平时真要写的东西原样丢进去,别用「写一首诗」这种测不出差距的题。
- 哪个顺手就用哪个,榜单只是帮你把候选从几十个缩到两三个。
温馨提醒
- 榜单是参考,不是答案。 UP 主的测评有他自己的偏好和使用场景,你的活儿跟他不一样,结果就可能不一样。按排名挑两三个候选,再用自己的真实样本跑一轮,比直接照抄榜单靠谱。
- 排名会变。 模型隔几个月就升级一次,今天的第一过两个月可能就换了。隔一段时间回来看一眼,别拿老榜单当长期结论。
- 别被「总冠军」带偏。 你只用其中一项能力,那就只看那一项的排名。
- 榜单里包含不少海外模型(ChatGPT、Claude、Gemini 等),这些在国内使用需要你自己解决访问环境,别看到排名高就去搜「代充」「加速器」——那正是骗子最多的地方。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法