Arena AI(LLM 排行榜与模型竞技场)

简介
本目录条目标题“Attention Required! | Cloudflare”是抓取事故——它并非产品名,而是 Cloudflare 拦截页的标题。条目实际指向 arena.ai,即 Arena AI,一个自称“官方 AI 排名与 LLM 排行榜”的模型竞技场平台:用户直接对话各家大模型,通过匿名盲测投票生成公开排名,模式上与 LM Arena(原 LMSYS Chatbot Arena)相近。平台运营方背景公开资料有限,具体以官网为准。
主要功能
- 盲测对战:同一提示同时发给两个匿名模型,比较回答后投票,投票进入排行榜计算。
- Elo 公开榜单:按总体、文本、编程、视觉等赛道对数百个模型(含 Claude、GPT、Gemini、Kimi、GLM、Grok、DeepSeek 等)排名,并附价格与上下文窗口信息。
- 直接体验前沿模型:无需逐一注册厂商账号,在网页对话界面即可试用各家最新模型。
- 图像生成与编辑:平台近期放宽了图像编辑的使用限制,可在对话流程中处理图片。
特色优势
- 排名来自真实用户投票而非固定测试集,更贴近实际使用体验,被开发者当作模型选型的外部参考信号。
- 免费使用:网页端对话与投票不收费;作为交换,官网隐私说明提示用户对话会披露给相关 AI 提供商并可能用于自动化评测。
- 覆盖面广:同一界面横向对比闭源与开源模型,便于权衡能力与成本(如每百万 token 单价)。
- 与静态基准互补:相比 MMLU 等实验室指标,这类投票式排名更看重模型“实际用起来如何”。
适用人群
需要为产品选型的大模型应用开发者、做模型对比调研的研究人员、频繁切换模型体验的普通用户与 AI 爱好者,以及关心“哪个模型最值得用”的企业技术决策者。
常见问题
问:arena.ai 收费吗?答:对话与投票免费;注意其隐私说明提示对话内容会分享给相关 AI 提供商用于评测。
问:排名是怎么算的?答:基于用户对匿名模型回答的投票,用 Elo 评分体系生成公开排行榜,覆盖总体、文本、编程、视觉等多个赛道。
问:和 LM Arena(原 Chatbot Arena)有什么区别?答:两者都是盲测投票加排行榜模式;arena.ai 是独立运营的榜单平台,还提供图像编辑等差异化功能。





