2026-06-25 12:46 天天模拟器
阿里云于5月9日正式推出通义千问2.5版本,其模型性能全面超越GPT-4 Turbo,被业界誉为中文能力最强的大模型。
根据官方透露,通义千问2.5最新开源的1100亿参数模型在多项基准测试中均斩获最佳成绩,成功超越Meta的Llama-3-70B模型,树立了开源领域的新标准。
与通义千问2.1版本相比,通义千问2.5在四项关键能力上分别提升了9%、16%、19%和10%,其中文能力更是持续领先行业水平。
在权威评测平台OpenCompass上,通义千问2.5的得分与GPT-4 Turbo持平,这是该评测中首次有国产大模型达到如此优异的成绩。这不但印证了通义千问2.5在中文环境中的出色表现,也彰显了阿里云在人工智能领域的创新实力。
除了通义千问2.5,阿里云还发布了最新开源模型Qwen1.5-110B。这款拥有1100亿参数的模型在MMLU、TheoremQA、GPQA等基准测试中均超越Meta的Llama-3-70B模型,并在HuggingFace推出的开源大模型排行榜Open LLM Leaderboard上位居榜首,进一步巩固了通义开源系列在业界的领先地位。
值得关注的是,通义千问代码大模型CodeQwen1.5-7B也是一大亮点。该模型在HuggingFace代码模型榜单Big Code上名列前茅,同时还是国内用户量最大的智能编码助手通义灵码的底层支撑。
