阿里 Qwen3.7-Max 编程力登顶国产第一:1541 分超越全球仅次 Claude
2026-05-27 15:18:40
5 月 26 日消息:5 月 26 日凌晨,全球权威三方编程榜单 Code Arena 放榜。阿里最新旗舰模型 Qwen3.7-Max 得分 1541,超越 GPT-5.5、Gemini-3.5-Flash、GLM-5.1、Kimi-K2.6 等一众模型,仅次于 Claude 系列,在大模型厂商中排名全球第二;这也标志着在代码理解与生成领域,千问 3.7 成功跻身全球编程模型第一梯队。

据了解,编程能力是当下模型智能水平的核心指标,而Code Arena是由知名第三方大模型盲测平台LMArena推出的最具影响力的榜单之一。
与传统的代码基准测试不同,Code Arena并不考核孤立的代码片段生成或传统算法题,而是由开发者出题,要求模型从零生成完整的、可交互的Web应用程序,并交由用户对匿名模型的生成效果进行两两PK,由投票综合生成榜单,因此Code Arena也被认为是目前全球最具公信力的AI编程能力评测之一。
经全球开发者以真实使用体验盲测投票,千问3.7模型编程能力位居前4,打破由Claude-Opus-4.7和4.6统治已久的前四格局,Qwen3.7-Max也成为目前榜单中唯一突破1540分大关的国产大模型。
据了解,面向Agent打造的Qwen3.7-Max在编程、智能体、长程任务等核心能力上实现了大幅突破,不但能在数小时内独立完成专业团队耗时2周的复杂项目端到端交付,大幅提升办公自动化和企业级生产力,甚至可以持续运行35小时、累计超1000次工具调用的复杂长程任务,自我编程优化芯片内核。
相关阅读
-
国产 AI 新爆发:MiniMax M3 大模型即将发布,性能提升 10-15 倍金融科技前沿 2026-05-27 15:13:26
-
潮汕 00 后博士创业:千元眼罩 3 个月获融资,揭秘新消费爆款逻辑深度解读 2026-05-27 15:12:51
-
武契奇称买不起小米汽车?雷军回应 YU7 定价 23.35 万:年薪不足 20 万金融科技前沿 2026-05-27 15:07:04
-
抖音 VS 小红书:拼豆冠名权争夺战,谁将胜出?深度解读 2026-05-27 15:06:37
-
技嘉 40 周年大促:购 RTX 5090 显卡赠 1 克 999 纯金,买显卡送真黄金金融科技前沿 2026-05-27 15:01:35
-
这些症状不是累,是大脑在求救!出现这几种信号必然要注重深度解读 2026-05-27 15:01:28
-
小鹏 GX 爆单!何小鹏回应:我的两台先不提,致其他下定车主深度解读 2026-05-27 14:56:46
-
AMD Zen7 架构曝光:台积电 1.4nm 工艺加持,448MB 3D 缓存创历史巅峰金融科技前沿 2026-05-27 14:56:09
-
Meta 裁员 7800 人:扎克伯格称利用员工数据训练 AI 效果更佳深度解读 2026-05-27 14:51:45
-
李斌:未来 1-2 年车市迎最残酷决赛,蔚来将如何破局?金融科技前沿 2026-05-27 14:49:39