Skip to main content
智谱的 GLM 系列,从轻量到旗舰型号齐全。
  • 接口:POST https://token.poryf.com/v1/chat/completions(OpenAI 格式),字段说明见 创建对话
  • 在线试用需要登录,按自己的余额扣费

可用型号

型号会随渠道调整增减,以 模型广场 和 GET /v1/models 为准。

调用示例

换成其他型号,只需替换 model。需要逐字输出时加 "stream": true,见 流式输出。

计费

  • 按输入、输出、缓存命中 token 分别计价。
  • glm-5.3、glm-5.3-flashx、glm-5.3-flash、glm-5.2 只有一档单价。
  • glm-5.1、glm-5、glm-5-turbo 按输入长度分档:输入低于 32K token 一档,32K 及以上一档。
  • glm-4.7、glm-4.5-air 分三档:短输入短输出(输入低于 32K 且输出低于 200 token)、短输入长输出、长输入(32K 及以上)。
实时单价见 模型广场,每次调用的实际用量与扣费见 使用日志。
  • max_tokens 包含思考过程。推理型号设得太小时,额度可能全部用于思考,content 为空。
  • 本站文本模型目前不支持在对话中识别图片。