智谱(HK2513)今日正式上线GLM-5.3-FlashX,API同步全面开放。新版本推理速度最高可达200tokens/s,是GLM-5.3-Flash速度的5倍,定价提升至原版的2.5倍。
GLM-5.3-FlashX就是那个被称为“神秘模型”“牛来模型”的GLM-5.3-Flash升级版,速度更快、价格更高。
8月20日,GLM-5.3-Flash以“Ox Alpha(ALP)”匿名模式在OpenRouter上线测试,因为来路不明、表现强劲,被网友戏称“牛来”,直到8月26日智谱(HK2513)才正式认领并开源。
据智谱(HK2513)介绍,由10万张国产芯片组成的推理集群上线即满负荷运行。面对超预期的需求,智谱(HK2513)再次扩大算力规模,并推出速度更快、定价更高的FlashX版本,以承接不断增长的调用需求。
GLM-5.3-Flash凭借同尺寸模型中领先的智能水平与高性价比积累了竞争优势。此次FlashX将输出速度提升至最高200tokens/s,在保持智能水平的同时,进一步提升响应效率,为重视速度与交互体验的开发者提供新的选择。
值得关注的是,GLM-5.3-Flash此前已具备较为可观的毛利率,FlashX提价有望带动收入和利润率同步提升。
截至9月18日15时左右,智谱(HK2513)股价涨近6%,盘中涨幅超7%。
