文章摘要
原代号为Ox Alpha的GLM-5.3-Flash因表现突出获全球开发者认可,调用量持续增长。智谱团队基于十万张国产芯片提供的推理算力优化性能后,正式推出升级款GLM-5.3-FlashX,最高速度达200tokens/s,该模型在智能表现、使用成本、响应速度上形成全面竞争优势,目前已正式上线,开放API调用、体验中心试用两种使用途径。

此前以“Ox Alpha”代号对外亮相的GLM-5.3-Flash模型,凭借出色的综合表现获得了全球开发者的广泛认可,调用量持续攀升。为了适配快速增长的业务需求,研发团队在10万张国产芯片提供的推理算力基础上,进一步加大了对底层架构侧的投入与推理性能优化工作。

今日,团队正式推出升级后的GLM-5.3-FlashX(最高200 tokens/s),为企业与开发者带来更快、更流畅的模型使用体验。GLM-5.3-Flash本身就长期保持同尺寸下最强的智能水平,同时具备极高的性价比,此次提速进一步让其在智能表现使用成本响应速度三个维度形成了全面的竞争优势。

目前GLM-5.3-FlashX API已经正式上线,对应的调用密钥为:GLM-5.3-FlashX。

使用途径主要分为两种:

  • API接口调用:开发者可通过官方开放的API接口完成模型调用
  • 体验中心试用:可通过官方体验中心直接上手测试模型功能
以上内容不代表本平台立场,仅供读者参考