【软盟资讯 · 7×24快讯】(2026年09月18日) 智谱正式上线GLM-5.3-FlashX,API推理速度最高达200 tokens/s,较GLM-5.3-Flash提升5倍,价格约为原版本的2.5倍。此次更新未更换底层基座,重点在于提升推理速度与服务能力,针对高并发、低延迟的规模化调用场景进行优化。FlashX的推出,为需要实时交互、大批量并行处理的开发者提供了更高吞吐的选项,也延续了智谱在Flash系列上“更快更高性价比”的产品策略,进一步拉开与纯速度型竞品的差距。
【软盟资讯 · 7×24快讯】(2026年09月18日) 智谱正式上线GLM-5.3-FlashX,API推理速度最高达200 tokens/s,较GLM-5.3-Flash提升5倍,价格约为原版本的2.5倍。此次更新未更换底层基座,重点在于提升推理速度与服务能力,针对高并发、低延迟的规模化调用场景进行优化。FlashX的推出,为需要实时交互、大批量并行处理的开发者提供了更高吞吐的选项,也延续了智谱在Flash系列上“更快更高性价比”的产品策略,进一步拉开与纯速度型竞品的差距。