Chatbot Arena

8个月前发布 24 00

Chatbot Arena是一个大型语言...

收录时间：

2024-10-18

打开网站

AI模型评测 # AI模型评测

Chatbot Arena

打开网站

Chatbot Arena是一个大型语言模型 (LLM) 的基准平台，以众包方式进行匿名随机对战，该项目方LMSYS Org是由加州大学伯克利分校、加州大学圣地亚哥分校和卡内基梅隆大学合作创立的研究组织。

通过demo体验地址进入对战平台，输入自己感兴趣的问题，提交问题后，匿名模型会两两对战，分别生成相关答案，需要用户对答案做出评判，从4个评判选项中选择一个：模型A更好、模型B更好、平手、都很差。支持多轮对话。最终使用Elo评分系统对大模型的能力进行综合评估。(可以自己指定模型看效果，但不计入最终排名情况)。

数据统计

暂无评论

您必须登录才能参与评论！

立即登录

暂无评论...

Chatbot Arena

数据统计

相关导航

Open LLM Leaderboard

LLMEval3

OpenCompass

MMLU

SuperCLUE

CMMLU

C-Eval

FlagEval

暂无评论