智谱发布 GLM-5.3-FlashX,推理速度最高达 200 tokens/s
智谱 AI 正式推出全新模型 GLM-5.3-FlashX。该模型主打高性能与低延迟,最高推理速度可达 200 tokens/s。目前,GLM-5.3-FlashX API 已全面上线,开发者可使用 Model Key"GLM-5.3-FlashX"进行调用。
财联社Al daily
智谱 AI 正式推出全新模型 GLM-5.3-FlashX。该模型主打高性能与低延迟,最高推理速度可达 200 tokens/s。目前,GLM-5.3-FlashX API 已全面上线,开发者可使用 Model Key"GLM-5.3-FlashX"进行调用。