为企业 AI 团队而生

多模型采购,
一份合同。统一预付费、组织级权限、自动容灾。

预约演示
— ACME Inc
实时
余额
¥ 12,840
本月 token
24.7M
活跃成员
17
P95 延迟
28 ms

平台优势。

TokenHouse
$10.00
+5.5%
其他
$10.55
0% 平台手续费

模型官方定价直通,不加一分钱。同等调用量下,比加价网关更省成本。

sk-tokenhouse_••••••••
ClaudeGLM
一把 Key 用所有模型

Claude 与 GLM 等前沿模型统一接入,一个 endpoint,完全兼容 OpenAI 与 Anthropic 协议。

近 7 日用量实时
今日$58
本周$421
本月$1,464
精细化成本洞察

按 Key、成员与日 / 周 / 月维度实时查看用量与花费,每笔花费可追溯,账单一目了然。

正式上线
集成对接
架构设计
需求梳理
AI 落地咨询

想把 AI 嵌入你的业务流程?付费咨询涵盖架构设计到正式上线,全程陪跑。

请求TokenHouse模型
不记录不训练自动删除
零内容留存

Prompt 与返回内容默认不记录、不训练,仅保留请求来源与 Token 用量等计费数据。

Traces
LangfuseDatadogGrafana
LLM 可观测性即将上线

按需开启 Prompt 与响应日志,转发至 Langfuse、Datadog 等平台做调试分析。

可靠性优先。

/ 01 · Failover
自动多区域容灾
单一供应商被限流或故障时,自动切换通道,客户端无感。
primaryfailover ●cross-region
/ 02 · Streaming
流式断流,绝不漏扣
余额 95% 实时断流;失败请求一律不扣。
已用
95% ⚡

改一行 base_url。

anthropic.ts
@anthropic-ai/sdk
1import Anthropic from "@anthropic-ai/sdk";
2
3const client = new Anthropic({
4 apiKey: "sk-tokenhouse_•••",
5 baseURL: "https://api.tokenhouse.ai"
6});
7
8const msg = await client.messages.create({
9 model: "claude-opus-4-8",
10 max_tokens: 4096,
11 messages: [...]
12});
stream.sh
cURL
1curl https://api.tokenhouse.ai/v1/chat/completions \
2 -H "Authorization: Bearer sk-tokenhouse_•••" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "glm-4.7",
6 "stream": true,
7 "messages": [...]
8 }'
9
10data: {"choices":[{"delta":{"content":"Hi"}}]}
11data: [DONE]

为团队准备的一切。

ACME Inc · production
Owner
组织余额
¥ 12,840.20
+ ¥10,000 · 5h
本月消费
¥ 7,162.40
↗ +24%
本月 token
24.7 M
Claude 64% · GLM 36%
P95 延迟
28 ms
↘ −3ms
近 30 天用量
ClaudeGLM

常见问题。

为什么不直接接入各家 API?
一把 Key 接入 Claude、GPT、GLM 全系列;货币统一、账单统一、配额统一;单家故障自动走备用通道。
OpenAI 兼容协议覆盖哪些能力?
Chat Completions、SSE Streaming、Tool Use、Vision 全部透传。已用 OpenAI SDK 的代码只改 base_url 即可。
Flex 和 Strict 模式怎么切换?
余额 > 阈值(默认 ¥200)进入 Flex —— 跳过预扣零延迟;接近阈值时自动切 Strict —— 智能预估,绝不超扣。
流式调用余额耗尽时会发生什么?
达到 95% 时发 SSE error 并断流;已生成内容保留;失败请求一律不扣。
企业可以使用自有模型账户吗?
可以。Enterprise 支持接入客户自有账户使用自有配额;也支持独立部署到客户 VPC 内。
可以开发票吗?
可以。月度账单可下载 PDF/CSV;如需正式收据请联系客服 support@tokenhouse.ai

5 分钟接入。

文档