阿里AI三连发,连夺三项第一!
7月25日,阿里阿里巴巴全新开源千问3推理模型,连发连夺性能大幅提升,项第一举夺下「全球最强开源模型」王座,阿里比肩顶级闭源模型Gemini-2.5 pro、连发连夺o4-mini。项第本周阿里已连续开源3款重磅模型,阿里分别斩获基础模型、连发连夺编程模型、项第推理模型等主流领域的阿里三项全球开源冠军。两天前开源的连发连夺AI编程模型Qwen3-Coder,更是项第引爆全球AI圈,掀起一波用中国千问开源模型替代闭源模型的阿里新浪潮。
最新推出的连发连夺千问3推理模型,登顶全球最强开源推理模型。项第 自千问3旗舰模型Qwen3-235B-A22B发布后,阿里通义团队一直在扩展大模型的推理极限,全新开源的千问3推理模型在通用能力和深度思考能力上实现巨大飞跃。千问3推理模型支持256K上下文长度,在知识(SuperGPQA)、编程(LiveCodeBench v6)、数学(AIME25)、人类偏好对齐(Arena-Hard v2)、创意写作(WritingBench)、多语言能力(MultilF)等核心能力上,千问3推理模型完全可比肩Gemini-2.5 pro、o4-mini等顶尖闭源模型,并创下全球开源模型的最佳性能表现。

在经典基础模型领域,千问3全球最强。3天前开源的Qwen3-235B-A22B-Instruct-2507(非思考版)新模型,性能显著提升,在GPQA(知识)、AIME25(数学)、LiveCodeBench(编程)、Arena-Hard(人类偏好对齐)、BFCL(Agent能力)等众多测评中表现出色,超越Claude4(Non-thinking)等领先闭源模型。权威AI研究机构Artificial Analysis指出,“千问3是全球最智能的非思考基础模型”。

在AI编程领域,新开源的Qwen3-Coder被誉为「全球最好的编程模型」。Qwen3-Coder在代码能力及Agent调用能力方面取得重大突破。在多语言SWE-bench、Mind2Web、Aider-Polyglot等模型Agent能力评估中,Qwen3-Coder超越GPT4.1、Claude4等顶级闭源模型,并登顶全球最大AI开源社区HuggingFace 模型总榜冠军。借助Qwen3-Coder,刚入行的程序员一天就能完成资深程序员一周的工作,生成一个品牌官网最快只需5分钟。
Qwen3-Coder的开源,引爆硅谷科技圈,在全球AI圈掀起一波「AI编程」热潮。推特创始人杰克·多尔西(Jack Dorsey)、爆火Agent应用Perplexity CEO 阿拉温德·斯里尼瓦斯(Aravind Srinivas)、著名风投公司a16z合伙人马克·马斯克罗(Marco Mascorro)等硅谷大咖盛赞Qwen3-Coder,HuggingFace CEO 克莱门特·德朗格(Clement Delangue)更是连转带发12条推文,向全球开发者力荐这一最好的编程模型。海外知名模型API聚合平台OpenRouter数据显示,阿里千问API调用量暴涨,过去几天已突破1000亿Tokens,在OpenRouter趋势榜上包揽全球前三,是当下最热门的模型。

截至目前,阿里巴巴已开源300余款通义大模型,通义千问衍生模型突破14万个,超越Meta的Llama系列成为全球第一的开源模型家族,通义也是开发者和企业使用最广泛的大模型。未来三年,阿里巴巴还将投入超过3800亿元用于建设云和AI硬件基础设施,持续升级全栈AI能力,为中国和全球开发者和企业提供更先进的模型和云计算服务。
- ·《地铁2039》技术细节公布 主机30帧电影级画面!
- ·重大疾病保险医疗险,成人重大疾病保险医疗险
- ·铁路女警因犬成就浪漫姻缘 将丈夫引上训导警犬之路
- ·厦门中考成绩和九科等级划线出炉
- ·交行滁州分行首笔“免申贷”落地赋能小微企业发展_
- ·450名青年成为新型职业农民后备军
- ·厦门中考成绩和九科等级划线出炉
- ·玻璃厂家的整体库存表现较好,行业资讯
- ·开发者解释为何游戏关服后 无法出离线版
- ·2018年玻璃货物走势预测,行业资讯
- ·2025天生会画数字创作大赛圆满收官 数字艺术作品展登陆广州艺术博物院
- ·2026成人意外险哪个好性价比最高?成人意外险哪个保险公司最好
- ·婴儿意外险包括,儿童意外险有哪些品种?
- ·人保雇主责任险价格一览表,2026年人保雇主责任险多少钱一年?
- ·原厂电池免人工 OPPO开启官方电池安心换服务
- ·媒体聚焦丨雅虎财经关注中联重科:加速打造全系列高端新能源产品
