数智化转型网 人工智能资讯 每日人工智能资讯|智谱 GLM-5.3 发布:7400 亿参数没涨,靠后训练硬拉 50% 性能,编程能力逼近 Fable 5

每日人工智能资讯|智谱 GLM-5.3 发布:7400 亿参数没涨,靠后训练硬拉 50% 性能,编程能力逼近 Fable 5

8月14日,智谱正式发布大模型 GLM-5.3。基座参数量仍然是7400多亿,跟 GLM-5.2同一套底子,此前传闻的万亿参数升级并没有出现——那枚牌大概被留给了 GLM-5.5。但智谱靠着后训练这招,硬是让 GLM-5.3的性能比上一代提升了50%,在多项主流基准测试中拿下了当前开源模型最高排名,编程与智能体能力接近 Claude Fable5,编程体感超过其他国产模型。数智化转型网www.szhzxw.cn

几项关键基准的成绩跃升很有说服力。在衡量模型于真实终端环境中完成复杂任务的 Terminal-Bench3.0上,得分从4.6一口气蹿到28.3;聚焦长程软件工程与持续代码修改能力的 DeepSWE v1.1,从46.2涨到66.9;覆盖多类真实专业场景、强调跨工具协作与长程任务的 Agents’ Last Exam,从23.8提升到28.5。在覆盖44种职业、考察真实高价值知识工作的 GDPval-AA v2中,GLM-5.3拿到1769分,展现出基于编程能力涌现出的专业任务执行力。整体来看,它在复杂软件工程、终端操作和更广泛的真实世界 Agent 任务上都有显著进步。数智化转型网www.szhzxw.cn

最能说明问题的是智谱自研的 Z.ai Code Bench——这套评估把模型塞进真实的本地开发环境,在不同思考档位下执行端到端任务,尽可能还原开发者实际用 Coding Agent 时的体感。测试结果显示,GLM-5.3在效果和 Token 利用率之间找到了更好的平衡:High 档位下准确率达到31.4%,超过 Claude Opus4.8最高档位的29.5%,而每项任务平均只输出约5万 tokens,Opus4.8则需要约12万 tokens——意味着 GLM-5.3能用更短的执行路径走完同样的事。数智化转型网www.szhzxw.cn

产品落地方面,GLM-5.3即日起上线智谱官方编程工具 ZCode 和效率工具 AutoClaw,同步开放给 GLM Coding Plan 全量用户及订阅用户。TraeWork、TraeCode、扣子、WorkBuddy、CodeBuddy、Qoder、QwenWork、CatPaw、JoyCode、OpenCode 等第三方编码平台也开放了抢先体验。API 很快上线,完整模型权重将在两周内完成必要的安全加固后开源——智谱的策略是尽可能限制模型的潜在攻击能力,同时保留其防御价值。今天13:00,GLM Coding Plan 全员额度已经重置,所有用户后台的用量统计均可看到额度回满。数智化转型网www.szhzxw.cn

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/137104.html
1
标签:
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部