智谱GLM-5.3-FlashX上线:最高 200 tokens/s

智谱今天端出了新模型 GLM-5.3-FlashX,官方标出的最高速度冲到了每秒200个 token,给企业开 […]

智谱今天端出了新模型 GLM-5.3-FlashX,官方标出的最高速度冲到了每秒200个 token,给企业开发者的体验按下了加速键。

image.png

这款提速型号的底子,是那款此前以"Ox Alpha"之名先和全球开发者见面的 GLM-5.3-Flash——它靠着同尺寸里最能打的智能水平,在海外内圈了一波口碑,调用量一路往上爬。需求涨得太快,智谱索性在10万张国产芯片撑起的推理算力之上,继续往 Infra 基建和推理优化里砸资源。于是 FlashX 不只是快,而是把智能、价格、速度这三张牌第一次同时攥在了手里。

image.png

目前 GLM-5.3-FlashX 的 API 已经上线,开发者调用时认准 Model Key:GLM-5.3-FlashX 即可。对苦于大模型"想得慢、等得久"的生产场景来说,每秒200token 这条线,意味着它能在不牺牲聪明程度的前提下,把响应延迟压到一个相当轻快的档位。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发

AI资讯AI新闻资讯正文GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发发布于AI新闻资讯发布时间 :2…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%

AI资讯AI新闻资讯正文微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%发布于AI新闻资讯发布时间 :2026年9月…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI首个达“关键”门槛的Astra因能力太强遭安全限速

OpenAI下一代模型Astra将推出,但严格限制其网络安全功能。该模型为首个达《准备框架》“关键”网络安全能 […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来

AI资讯AI新闻资讯正文OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来发布于AI新闻资讯发布时间 :2026年9月7号 9:34阅读 :1…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Marvis上线自定义模型功能,支持接入Kimi、智谱GLM等主流模型

腾讯AI助手Marvis上线“自定义模型”功能,用户可接入腾讯云、阿里云、DeepSeek、Minimax、K […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话

AI资讯AI新闻资讯正文Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话发布于AI新闻资讯发布时间 :2026年9月7号 9:36阅读 :…
📅 09-20 · 👁 2026年9月20日