斯坦福大模型评测榜:Claude 3第一

三言科技6月23日消息,日前,斯坦福大学基础模型研究中心发布大规模多任务语言理解能力评估排行榜,其中,综合排名前十的大语言模型中有两款来自中国厂商,分别是阿里巴巴的 Qwen2 Instruct(72B)和零一万物的 Yi Large(Preview)。

排名如下:

1、Claude 3 Opus(20240229): Anthropic(美国,亚马逊投资)

2、GPT-4o(2024-05-13):OpenAI(美国)

3、Gemini 1.5 Pro:谷歌(美国)

4、GPT-4(0613):OpenAI(美国)

5、Qwen2 Instruct(72B):阿里巴巴(中国)

6、GPT-4 Turbo(2024-04-09):OpenAI(美国)

7、Gemini 1.5 Pro(0409 preview):谷歌(美国)

8、GPT-4 Turbo(1106 preview):OpenAI(美国)

9、Llama 3(70B):Meta(美国)

10、Yi Large(Preview):零一万物(中国)