GLM-4.7 Flash 是 GLM 系列的轻量极速版本,响应快、成本极低,适合高频对话与轻量任务。
代码示例
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokenhouse.ai/v1",
api_key="YOUR_TOKENHOUSE_KEY",
)
resp = client.chat.completions.create(
model="glm-4.7-flash",
messages=[
{"role": "user", "content": "你好!"}
],
)
print(resp.choices[0].message.content)
支持协议
OpenAIopenai
/v1/chat/completions/v1/responses
常见问题
GLM 4.7 Flash 的输入价格为 $0.07/M、输出价格为 $0.4/M。按量计费,无月费,模型官方定价直通、不加价。
GLM 4.7 Flash 支持 203K 的上下文窗口,最大输出 4K。
将你的 base_url 指向 https://api.tokenhouse.ai/v1,使用 TokenHouse API Key,并把模型设为 glm-4.7-flash 即可。完全兼容 OpenAI SDK,无需改动其他代码。
GLM 4.7 Flash 支持 对话、函数调用,由 Z.ai 提供。