当前位置:主页 > 热点 >

阿里云通义千问Qwen2.5-Max登顶AI大模型榜单

时间:2025-02-06 22:16:10

  阿里云近日公布了其全新的通义千问Qwen 2.5-Max超大规模MoE模型,并宣布在多个基准测试中超越DeepSeek V3等竞争对手。阿里云表示,Qwen2.5-Max在Chatbot Arena大模型盲测中,以1332分位列全球第七名,成为非推理类的中国大模型冠军。

  Qwen2.5-Max在数学和编程等单项能力上排名第一,在硬提示(Hard prompts)方面排名第二。这一成绩展示了阿里云在AI技术领域的领先地位。

  据公开资料显示,Chatbot Arena是由LMSYS Org推出的大模型性能测试平台,目前集成了190多种模型。该榜单采用匿名方式将大模型两两组队,交给用户进行盲测,用户根据真实对话体验对模型能力进行投票。因此,Chatbot Arena LLM Leaderboard成为业界公认的最公正、最权威榜单之一,也是全球顶级大模型的最重要竞技场。

  阿里云表示,在Arena-Hard、LiveBench、LiveCodeBench、GPQA-Diamond及MMLU-Pro等主流基准测试中,Qwen2.5-Max比肩Claude-3.5-Sonnet,并几乎全面超越了GPT-4o、DeepSeek-V3及Llama-3.1-405B。

热点推荐
1 OTC鲸鱼卖出29000枚ETH获利640万美元

OTC鲸鱼在5小时前卖出了29,000枚以太坊,价值约5310万美元,此前他在上周的市场回调中购入这些...

2 美国政府转移34.9万美元FTXAlameda查没资产

消息,据onchainlens监测,美国政府托管的FTX/Alameda破产案查没资金的地址转移了价值34.9万美元的...

3 向黎巴嫩南部地区的以色列部队发射火箭

消息,黎巴嫩真主党:向黎巴嫩南部地区的以色列部队发射火箭弹和炮弹,目前冲突仍在持续...

4 美加州州长称特朗普指示司法部对其展开

消息,美国加利福尼亚州州长纽森15日指责总统特朗普将他视为政治敌人,并指示司法部对其展...

5 俄罗斯TANECO炼油厂在6月12日遭无人机袭击

消息,据消息人士透露,俄罗斯TANECO炼油厂在6月12日遭无人机袭击后暂停了运营。...

6 Anthropic公司代表周一将与美国商务部官员

消息,Anthropic公司代表周一将在美国商务部与美国官员会面,解决出口管制相关争端。...

7 Bimine持有以太坊562万枚,亏损超95亿美元

消息,Bimine的以太坊持仓目前亏损超过95亿美元,但仍在继续增持。根据Lookonchain数据,Bimine最...

8 疑似Arthur Hayes关联地址从Flow Desk收到300

消息,据Onchain Lens监测,一个疑似与Arthur Hayes关联的钱包地址从Flow Desk收到3000枚ETH,价值约...

9 麻吉大哥黄立成加仓以太坊多单,持仓

消息,麻吉大哥黄立成持续加仓25倍杠杆的以太坊多单,持仓达1.01万枚ETH,清算价1811美元,浮...

10 伊朗外交部:资产解冻和战争赔偿是谅解

消息,当地时间15日,伊朗外交部发言人巴加埃在当天举行的新闻发布会上表示,伊美停战谅解...

成都来彰科技 蜀ICP备2025134723号-1

资讯来源互联网,如有版权问题请联系管理员删除。