TokenHouse.AI 开发者文档

TokenHouse 是企业级 LLM API 聚合平台:一把 Key 接入 Claude 与 GLM 全系列模型,统一计费、统一容灾,底层经 AWS Bedrock 提供服务。

接入只需三件事

  1. Base URLhttps://api.tokenhouse.ai
  2. API Key — 在控制台创建,鉴权用 HTTP 头 Authorization: Bearer <your-key>
  3. 模型名 — 用别名(claude-opus-4-8glm-4.7)或规范键(anthropic.claude-opus-4-8

协议兼容

网关同时兼容 OpenAIAnthropic 两套协议。你现有的 OpenAI / Anthropic SDK、Claude Code、Codex 等工具,改一下 base URL 和 Key 即可直连。

端点总览

端点协议用途计费
POST /v1/chat/completionsOpenAI Chat对话补全,流式可选
POST /v1/responsesOpenAI ResponsesResponses 协议无状态桥接
POST /v1/messagesAnthropic Messages对话补全,流式可选
POST /v1/messages/count_tokensAnthropic预估请求 token 数
GET /v1/modelsOpenAI list 格式列出当前可调用模型

所有端点均需通过 Authorization: Bearer <your-key> 传入 Key(或使用 Anthropic 原生的 x-api-key 头)。

/v1/responses 桥接是无状态的:不支持 previous_response_id(带上会返回 400),也不支持 web_search / file_search / computer_use / 图像工具。对话、function 工具调用、reasoning 与流式 SSE 均完整支持。详见 Codex 接入

模型命名

同一个模型有两种等价写法,网关都接受:

  • 别名claude-opus-4-8claude-sonnet-4-6glm-4.7 等,简短易记
  • 规范键anthropic.claude-*zai.glm-*,带供应商前缀

调用 GET /v1/models(需鉴权)可拿到当前账号可调用的完整列表;gpt-* 系列当前不可调用。各模型能力与价格见模型列表定价

工作原理

  • 统一经 AWS Bedrock 提供 — Claude 与 GLM 全系列经 Bedrock 接入,一把 Key 全覆盖。
  • 组织级预付费钱包 — 整个组织共享一个预付费余额池,所有 Key 的消耗统一计入,充值与余额在控制台管理。
  • 失败请求不计费 — 4xx / 5xx / 超时一律不扣费;只有成功产生输出的请求按 token 计费。
  • 全端点支持流式 — 各对话端点均支持流式 SSE 输出。

下一步