AI比特网
榜单与评测lmarena.ai

LMArena

大模型盲测竞技场:真实用户投票的排行榜

8.9

编辑评分 / 10

前身为 Chatbot Arena:让用户对两个匿名模型的回答盲投,用 Elo 机制生成排行榜。因为难以刷榜,被广泛视为最接近真实体验的模型榜单,文本、视觉、编程分榜齐全。

优点

  • +盲测机制难作弊
  • +分场景排行细
  • +可顺手对比两个模型的真实回答

局限

  • 偏好'讨喜'风格的回答存在争议
  • 对垂直专业任务参考有限

价格

免费

适合谁

模型选型者AI产品经理普通用户

典型场景

选型前查综合排名、亲手盲测感受模型差异、跟踪新模型上榜表现。

看榜单只看一个的话,先看它——然后一定用自己的任务再实测一遍。

—— AI比特网编辑部

想学会把这类工具用进工作流?

我们的实战课程覆盖提示词、AI办公、AI编程与设计营销全场景。

查看AI课程

同类工具