新浪科技讯 9月18日下午消息,今日,智谱宣布上线GLM-5.3-FlashX,API同步全面开放。新版本推理速度最高可达200 tokens/s,较现有GLM-5.3-Flash提升5倍,定价提升至原版本的2.5倍。 需求持续超预期,算力扩容为业务增长提供支撑。此前,GLM-5.3-Flash以“Ox Alpha”之名面向全球开发者上线,凭借出色性能获得海内外开发者广泛认可,调用量持续攀升。据智谱介绍,由10万张国产芯片组成的推理集群上线即被打满。此次公司再次扩大算力规模,并推出价格更高、速度更快的FlashX版本,以承接持续增长的市场需求。 GLM-5.3-Flash长期保持同尺寸模型领先的智能水平,同时具备较高性价比。此次FlashX在延续模型能力优势的基础上,将输出速度提升至200 tokens/s,进一步改善使用体验,强化产品在智能水平、价格与响应速度等维度的综合竞争力。(文猛)
行业
智谱GLM-5.3-FlashX提价上线:推理速度翻5倍,提价至2.5倍
新浪科技讯 9月18日下午消息,今日,智谱宣布上线GLM-5.3-FlashX,API同步全面开放。新版本推理速度最高可达200 tokens/s,较现有GLM-5.3-Flash提升5倍,定价提升至原版本的2.5倍。 需求持续超预期,算力扩容为业务增长提供支撑。此前,GLM-5.3-Flash以“Ox Alpha”之名面向全球开发者上线,凭借出色性能获得海...