- 接口:
POST https://token.poryf.com/v1/chat/completions(OpenAI 格式),字段说明见 创建对话 - 在线试用需要登录,按自己的余额扣费
可用型号
型号会随渠道调整增减,以 模型广场 和 GET /v1/models 为准。
调用示例
model。需要逐字输出时加 "stream": true,见 流式输出。
计费
- 按输入、输出、缓存命中 token 分别计价。
glm-5.3、glm-5.3-flashx、glm-5.3-flash、glm-5.2只有一档单价。glm-5.1、glm-5、glm-5-turbo按输入长度分档:输入低于 32K token 一档,32K 及以上一档。glm-4.7、glm-4.5-air分三档:短输入短输出(输入低于 32K 且输出低于 200 token)、短输入长输出、长输入(32K 及以上)。
max_tokens包含思考过程。推理型号设得太小时,额度可能全部用于思考,content为空。- 本站文本模型目前不支持在对话中识别图片。