【php中文网快讯】据智谱官方消息,9月18日,glm-5.3-flashx模型正式发布,推理峰值速度达200 tokens/s。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
上个月,智谱推出的GLM-5.3-Flash模型曾以“Ox Alpha”为代号面向全球开发者开放测试(详情可参考此前PHP中文网报道:《智谱发布并开源GLM-5.3-Flash,牛来模型真实身份揭晓》),获得海内外开发者的广泛关注与积极反馈,API调用量持续攀升。该模型在同尺寸竞品中长期稳居智能水平第一梯队,兼具卓越性能与成本优势。
随着业务需求加速增长,智谱基于由10万张国产芯片组成的规模化推理算力集群,进一步强化底层基础设施建设,并持续推进推理引擎、调度架构与量化策略等多维度深度优化。
token智能省流助手,节省20%-70%token,自动对用户输入文本、代码片段、对话内容进行智能压缩,显著降低单次对话与上下文长度,从而节省模型推理开销、延长对话窗口、提升响应速度并降低 Token 消耗。
今日,智谱正式推出升级版模型GLM-5.3-FlashX,其API已全面开放,面向企业客户与开发者提供更迅捷、更稳定的大模型服务体验。相较前代GLM-5.3-Flash,新模型实现推理吞吐量5倍跃升,在智能能力、响应时效与综合性价比三方面构建全新竞争优势。据悉,GLM-5.3-FlashX定价为原版本的2.5倍。










