Token导航 LogoToken导航TokenDH.com

智谱推出GLM‑5.3‑FlashX大模型,峰值输出可达200 tokens/s

更新时间 2026-09-18来源 牛新网正文 314字阅读约 1分钟1 张图片

ITCOW牛新网 9月18日消息,智谱AI正式上线GLM‑5.3‑FlashX推理版本API,模型峰值生成速度最高200 tokens/s,面向企业与开发者提供更快的推理体验。

智谱推出GLM‑5.3‑FlashX大模型,峰值输出可达200 tokens/s

该模型的前身GLM‑5.3‑Flash此前以代号“Ox Alpha”对外提供服务,海内外调用量持续走高。智谱依托10万张国产芯片的推理算力集群,加大底层推理基础设施优化,在保留原有模型智能能力的基础上,进一步提升输出速度,实现智能、成本、速度综合竞争力。

目前该API已经开放调用,模型标识为GLM‑5.3‑FlashX,开发者可以查阅官方文档接入使用。

文章导航

阿里千问发布Qwen3.8‑Omni‑Flash原生全模态大模型,支持百万Token图文音视频输入
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多