☰

阿里云发布通义千问2.5，性能全面赶超GPT-4 Turbo

5月9日消息，阿里云正式发布通义千问2.5，模型性能全面赶超GPT-4 Turbo。同时，通义千问最新开源的1100亿参数模型在多个基准测评收获最佳成绩，超越Meta的Llama-3-70B，成为开源领域最强大模型。

据了解，相比通义千问2.1版本，通义千问2.5的理解能力、逻辑推理、指令遵循、代码能力分别提升9%、16%、19%、10%。在权威基准OpenCompass上，通义千问2.5得分追平GPT-4 Turbo，是该基准首次录得国产大模型取得如此成绩。

与此同时，通义还发布了最新款开源模型，1100亿参数的Qwen1.5-110B，该模型在MMLU、TheoremQA、GPQA等基准测评中超越了Meta的Llama-3-70B模型；在HuggingFace推出的开源大模型排行榜Open LLM Leaderboard上，Qwen1.5-110B冲上榜首。

据了解，通义千问视觉理解模型Qwen-VL-Max在多个多模态标准测试中超越Gemini Ultra和GPT-4V，目前已在多家企业落地应用；通义千问代码大模型CodeQwen1.5-7B则是HuggingFace代码模型榜单Big Code的头名选手。

“开发者的反馈和开源社区的生态支持，是通义大模型技术进步的重要助力。”阿里云CTO周靖人透露，未来通义大模型还会持续开源。根据最新数据，通义通过阿里云服务企业超过9万、通过钉钉服务企业超过220万，现已落地PC、手机、汽车、航空、天文、矿业、教育、医疗、餐饮、游戏、文旅等领域。

阿里云发布通义千问2.5，性能全面赶超GPT-4 Turbo

相关资讯