开源领域最强大模型!阿里云发布通义千问2.5:全面赶超GPT-4 Turbo

开源领域最强大模型!阿里云发布通义千问2.5:全面赶超GPT-4 Turbo

    正在检查是否收录...
一言准备中...

快科技5月9日消息,阿里云正式发布了通义千问2.5,模型性能全面赶超GPT-4 Turbo,声称地表最强中文大模型。

据了解,通义千问2.5最新开源的1100亿参数模型在多个基准测评中均取得了最佳成绩,成功超越了Meta的Llama-3-70B模型,成为开源领域的新标杆。

相比通义千问2.1版本,通义千问2.5在上述四项能力上分别提升了9%、16%、19%和10%,其中中文能力更是持续领先业界。

在权威基准OpenCompass上,通义千问2.5的得分追平了GPT-4 Turbo,这是该基准首次有国产大模型取得如此出色的成绩。这一成绩不仅证明了通义千问2.5在中文语境下的卓越性能,也展示了阿里云在人工智能领域的创新能力。

除了通义千问2.5外,阿里云还发布了最新款开源模型Qwen1.5-110B。这款拥有1100亿参数的模型在MMLU、TheoremQA、GPQA等基准测评中均超越了Meta的Llama-3-70B模型,并在HuggingFace推出的开源大模型排行榜Open LLM Leaderboard上荣登榜首,进一步巩固了通义开源系列在业界的领先地位。

通义的多模态模型和专有能力模型也展现出了业界顶尖的影响力。其中,通义千问视觉理解模型Qwen-VL-Max在多个多模态标准测试中超越了Gemini Ultra和GPT-4V,目前已在多家企业落地应用,为各行各业带来了实质性的帮助。

此外,通义千问代码大模型CodeQwen1.5-7B也是值得一提的亮点。这款模型在HuggingFace代码模型榜单Big Code上位居前列,同时还是国内用户规模第一的智能编码助手通义灵码的底座。

大模型gpt-4gptcodehuggingface多模态llama代码大模型智能编码模型性能视觉理解开源大模型人工智能编码助手排行榜国产大模型多模态模型影响力geminillm
  • 本文作者:WAP站长网
  • 本文链接: https://wapzz.net/post-13723.html
  • 版权声明:本博客所有文章除特别声明外,均默认采用 CC BY-NC-SA 4.0 许可协议。
本站部分内容来源于网络转载,仅供学习交流使用。如涉及版权问题,请及时联系我们,我们将第一时间处理。
文章很赞!支持一下吧 还没有人为TA充电
为TA充电
还没有人为TA充电
0
  • 支付宝打赏
    支付宝扫一扫
  • 微信打赏
    微信扫一扫
感谢支持
文章很赞!支持一下吧
关于作者
2.7W+
9
1
2
WAP站长官方

所有生命分子一夜皆可AI预测!AlphaFold 3改变人类对生命的理解,全球科学家都能免费使用

上一篇

阿里云发布通义千问2.5版 性能赶超GPT-4 Turbo

下一篇
  • 复制图片
按住ctrl可打开默认菜单