据阿里达摩院官网、新浪科技7月29日报道,阿里通义千问正式发布Qwen3-Max 2407版本(2026年7月版本),中文综合评测得分刷新SuperCLUE、C-Eval、CMMLU等多项中文权威榜单SOTA,全面超越Claude Opus 4.5。
Qwen3-Max 2407是Qwen3-Max系列的最新版本,参数规模达7200亿,采用稀疏MoE架构激活参数720亿。模型在中文理解、中文生成、中文推理、代码生成、多模态理解、Agent能力六大维度全面升级。SuperCLUE 2026年7月榜单显示,Qwen3-Max 2407综合得分92.4分,超过Claude Opus 4.5的88.7分,刷新中文大模型SOTA。
Qwen3-Max 2407在Agent能力维度表现尤为突出。在AgentBench v2.0评测中,Qwen3-Max 2407综合得分89.6,超过Claude Opus 4.5的82.1和GPT-5.6 Sol版的85.3。模型在企业级Agent任务完成率、多步推理准确率、工具调用准确率三个核心指标上均达到行业最高水平。
阿里集团CTO周明表示,Qwen3-Max 2407标志着国产大模型在中文综合能力上已全面领先海外模型。达摩院同步开源Qwen3-Max 2407的Lite版(72B参数),开发者可通过HuggingFace、ModelScope等平台下载。通义千问生态合作伙伴已突破10万家,覆盖电商、金融、教育、医疗、政务等20余个垂直行业。
Qwen3-Max 2407在企业服务市场已签约覆盖银泰商业、菜鸟网络、钉钉企业版、Lazada东南亚电商等核心场景。模型在中文数学竞赛能力评测CMCC 2026上得分96.8分,超过Claude Opus 4.5的89.2分、GPT-5.6 Sol版的92.4分。Qwen3-Max 2407同步上线「Qwen Skill」Agent模板市场,开发者可在市场发布自研Agent模板,单模板最高售价可至500万元。阿里云百炼平台已为Qwen3-Max 2407预留8000张昇腾950DT卡专属算力池,模型API响应时延低于80ms。
Qwen3-Max 2407在数学、代码、Agent三大场景的实测表现尤其亮眼。数学场景中,模型在AIME 2026数学竞赛评测得分92.4分,超过GPT-5.6 Sol版的89.1分;代码场景中,模型在HumanEval得分96.7,超过Claude Opus 4.5的92.3分;Agent场景中,模型在SWE-Bench Verified得分76.9,刷新Agent能力SOTA。Qwen3-Max 2407同步集成「Qwen Code」编程助手,单文件代码重构准确率达95.8%。该模型将成为阿里云「云上AI」战略的核心引擎,进一步巩固国产开源大模型在全球AI产业的领先地位。
若您对人工智能感兴趣,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

若您为人工智能服务商,可添加数智化转型网小助手Nora,加入人工智能行业交流群。

若您为人工智能创业者,可添加数智化转型网社群主理人Carina,加入人工智能创业交流群。

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

本文由数智化转型网(www.szhzxw.cn)转载,编辑/翻译:数智化转型网(Professionalism Achieves Leadership 专业造就领导者)迅龙
