阿里通义Qwen2.5进入大模型盲测全球前十

智东西9月29日消息，基准测试平台Chatbot Arena日前公布最新大模型盲测榜单，10天前发布的阿里通义千问开源模型Qwen2.5再次闯入全球十强，其大语言模型Qwen2.5-72B-Instruct排名大语言模型榜单第十，是前十唯一的中国大模型；Qwen系列视觉语言模型Qwen2-VL-72B-Instruct排名Vision榜单第九，是得分最高的开源大模型。

同一时间，全球开源社区基于Qwen系列二次开发的衍生模型数量突破7.43万，超越Llama系列衍生模型的7.28万。通义千问Qwen成长为世界最大的生成式语言模型族群，在Hugging Face社区的开源模型权威榜单Open LLM Leaderboard上，Qwen系列及其衍生模型包揽了前十全部座次。

Chatbot Arena是由开放研究机构LMSYS Org推出的知名大模型性能盲测平台。9月19日发布的Qwen2.5迅速进榜，旗舰模型Qwen2.5-72B-Instruct得分位列大语言模型榜单第十，居于OpenAI的o1、GPT-4o等模型之后，是得分最高的中国大模型；同天开源的视觉语言模型Qwen2-VL-72B-Instruct闯入Vision榜单第九，略逊于GPT-4o、Gemini-1.5-Pro等闭源模型，是成绩最好的开源模型。此前Qwen系列已有多款开源模型闯入Chatbot Arena榜单。