Gemini 3.5 Flash 是 Google 高性价比的主力多模态模型,擅长快速推理、长上下文与代码,百万级上下文适合规模化日常任务。
能力
对话图像理解函数调用深度推理提示词缓存联网搜索文件输入 代码示例
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokenhouse.ai/v1",
api_key="YOUR_TOKENHOUSE_KEY",
)
resp = client.chat.completions.create(
model="gemini-3.5-flash",
messages=[
{"role": "user", "content": "你好!"}
],
)
print(resp.choices[0].message.content)
支持协议
OpenAIopenai
/v1/chat/completions/v1/responses
Geminigemini
/v1beta/models/{model}:generateContent
常见问题
Gemini 3.5 Flash 的输入价格为 $1.5/M、输出价格为 $9/M。按量计费,无月费,模型官方定价直通、不加价。
Gemini 3.5 Flash 支持 1049K 的上下文窗口,最大输出 8K。
将你的 base_url 指向 https://api.tokenhouse.ai/v1,使用 TokenHouse API Key,并把模型设为 gemini-3.5-flash 即可。完全兼容 OpenAI SDK,无需改动其他代码。
Gemini 3.5 Flash 支持 对话、图像理解、函数调用、深度推理、提示词缓存、联网搜索、文件输入,由 Google 提供。