智谱9月18日正式发布GLM-5.3-FlashX大模型,最高推理速度达200 tokens/s,依托10万张国产芯片算力底座实现性能跃升,API已全面开放,定价上调至原版本的2.5倍,国产大模型竞争逻辑正式从卷参数上限转向拼推理效率。