模型目录

20个模型
google logo
Google: Gemini 3.1 Flash ImageOpenAIGemini
google/gemini-3.1-flash-image

Gemini 3.1 Flash Image(Nano Banana 2)通过对话即可生成与编辑图像,支持多分辨率与多种宽高比,适合创意生成与图像编辑。

上下文
131K
最大输出
8K
输入
$0.5/M
输出
$3/M
对话图像理解联网搜索图像生成
2026-05-28
anthropic logo
Anthropic: Claude Opus 4.8AnthropicOpenAI
anthropic/claude-opus-4-8

Claude Opus 4.8 是 Anthropic 当前最强的通用模型,具备一流的推理、代码与 Agent 能力,配合百万上下文胜任最具挑战的端到端任务。

上下文
1M
最大输出
8K
输入
$5/M
输出
$25/M
缓存读取
$0.5/M
缓存写
$6.25/M
对话图像理解函数调用深度推理提示词缓存文件输入
2026-05-28
google logo
Google: Gemini 3.5 FlashOpenAIGemini
google/gemini-3.5-flash

Gemini 3.5 Flash 是 Google 高性价比的主力多模态模型,擅长快速推理、长上下文与代码,百万级上下文适合规模化日常任务。

上下文
1049K
最大输出
8K
输入
$1.5/M
输出
$9/M
缓存读取
$0.15/M
对话图像理解函数调用深度推理提示词缓存联网搜索文件输入
2026-05-19
google logo
Google: Gemini 3.1 Flash-LiteOpenAIGemini
google/gemini-3.1-flash-lite

Gemini 3.1 Flash-Lite 是 Gemini 家族中最轻量、最低成本的层级,响应快、单价极低,适合高频对话与大规模轻量任务。

上下文
1M
最大输出
8K
输入
$0.25/M
输出
$1.5/M
音频输入
$0.5/M
缓存读取
$0.025/M
对话图像理解函数调用提示词缓存联网搜索音频处理
2026-05-07
openai logo
OpenAI: GPT-5.5OpenAI
openai/gpt-5.5

GPT-5.5 是 OpenAI 的旗舰前沿模型,深度长上下文推理与可靠的 agentic 执行,105 万 token 上下文,经 Azure OpenAI 提供。

上下文
1050K
最大输出
8K
输入
$5/M
输出
$30/M
缓存读取
$0.5/M
对话图像理解函数调用深度推理提示词缓存联网搜索
2026-04-24
anthropic logo
Anthropic: Claude Opus 4.7AnthropicOpenAI
anthropic/claude-opus-4-7

Claude Opus 4.7 是 Anthropic 的高自主性旗舰,专为复杂工程与长链路工作设计,在多步推理与长输出中表现稳定。

上下文
1M
最大输出
8K
输入
$5/M
输出
$25/M
缓存读取
$0.5/M
缓存写
$6.25/M
对话图像理解函数调用深度推理提示词缓存文件输入
2026-04-16
openai logo
OpenAI: GPT-5.4 NanoOpenAI
openai/gpt-5.4-nano

GPT-5.4 Nano 是最快最省的档位,面向高吞吐的分类、抽取与排序类负载,40 万 token 上下文,经 Azure OpenAI 提供。

上下文
400K
最大输出
8K
输入
$0.2/M
输出
$1.25/M
缓存读取
$0.02/M
对话图像理解函数调用深度推理提示词缓存联网搜索
2026-03-17
openai logo
OpenAI: GPT-5.4 MiniOpenAI
openai/gpt-5.4-mini

GPT-5.4 Mini 是低延迟、低成本的均衡型号,适合大规模日常任务与子代理,40 万 token 上下文,经 Azure OpenAI 提供。

上下文
400K
最大输出
8K
输入
$0.75/M
输出
$4.5/M
缓存读取
$0.075/M
对话图像理解函数调用深度推理提示词缓存联网搜索
2026-03-17
google logo
Google: Gemini Embedding 2OpenAIGemini
google/gemini-embedding-2

Gemini Embedding 2 是 Google 原生多模态向量模型,支持文本、图像等输入,可调维度(默认 3072),适合检索、聚类与 RAG。

上下文
8K
最大输出
2K
输入
$0.2/M
输出
音频输入
$6.5/M
图像输入
$0.45/M
视频输入
$12/M
图像理解音频处理视频理解向量嵌入
2026-03-10
openai logo
OpenAI: GPT-5.4 ProOpenAI
openai/gpt-5.4-pro

GPT-5.4 Pro 面向最高难度任务的深度推理档,仅经 Responses API(/v1/responses)提供,105 万 token 上下文,经 Azure OpenAI 提供。

上下文
1050K
最大输出
8K
输入
$30/M
输出
$180/M
对话图像理解函数调用深度推理联网搜索
2026-03-05
openai logo
OpenAI: GPT-5.4OpenAI
openai/gpt-5.4

GPT-5.4 是 OpenAI 的高性价比主力前沿模型,多步推理与 agentic 能力兼备,105 万 token 上下文,经 Azure OpenAI 提供。

上下文
1050K
最大输出
8K
输入
$2.5/M
输出
$15/M
缓存读取
$0.25/M
对话图像理解函数调用深度推理提示词缓存联网搜索
2026-03-05
anthropic logo
Anthropic: Claude Sonnet 4.6AnthropicOpenAI
anthropic/claude-sonnet-4-6

Claude Sonnet 4.6 延续 Sonnet 系列的高性价比,百万上下文与缓存让长会话更经济,适合规模化的日常任务。

上下文
1M
最大输出
8K
输入
$3/M
输出
$15/M
缓存读取
$0.3/M
缓存写
$3.75/M
对话图像理解函数调用深度推理提示词缓存文件输入
2026-02-17
z-ai logo
Z.ai: GLM 5OpenAI
z-ai/glm-5

GLM-5 是智谱最新旗舰,在中文理解、推理与多模态任务上表现出色,具备视觉与函数调用能力,原生中文优化使其在国内业务中尤为可靠。

上下文
200K
最大输出
8K
输入
$1/M
输出
$3.2/M
对话图像理解函数调用深度推理
2026-02-11
anthropic logo
Anthropic: Claude Opus 4.6AnthropicOpenAI
anthropic/claude-opus-4-6

Claude Opus 4.6 将上下文扩展到百万级,在大型代码库、长文档与长链路 Agent 场景中保持卓越的连贯性。

上下文
1M
最大输出
8K
输入
$5/M
输出
$25/M
缓存读取
$0.5/M
缓存写
$6.25/M
对话图像理解函数调用深度推理提示词缓存文件输入
2026-02-05
z-ai logo
Z.ai: GLM 4.7 FlashOpenAI
z-ai/glm-4.7-flash

GLM-4.7 Flash 是 GLM 系列的轻量极速版本,响应快、成本极低,适合高频对话与轻量任务。

上下文
203K
最大输出
4K
输入
$0.07/M
输出
$0.4/M
对话函数调用
2026-01-19
z-ai logo
Z.ai: GLM 4.7OpenAI
z-ai/glm-4.7

GLM-4.7 是 GLM 系列的高性价比主力,擅长中文对话与函数调用,在成本敏感的规模化场景中稳定可靠。

上下文
200K
最大输出
8K
输入
$0.6/M
输出
$2.2/M
对话函数调用
2025-12-22
anthropic logo
Anthropic: Claude Opus 4.5AnthropicOpenAI
anthropic/claude-opus-4-5

Claude Opus 4.5 在保持顶级能力的同时大幅下调价格,并引入 effort 调节以平衡质量与成本。适合高自主性 Agent 与复杂多步任务。

上下文
200K
最大输出
8K
输入
$5/M
输出
$25/M
缓存读取
$0.5/M
缓存写
$6.25/M
对话图像理解函数调用深度推理提示词缓存文件输入
2025-11-24
anthropic logo
Anthropic: Claude Haiku 4.5AnthropicOpenAI
anthropic/claude-haiku-4-5

Claude Haiku 4.5 是 Claude 家族中速度最快、成本最低的成员,延迟极低却保留可靠的推理与视觉能力,适合实时交互与高频调用。

上下文
200K
最大输出
4K
输入
$1/M
输出
$5/M
缓存读取
$0.1/M
缓存写
$1.25/M
对话图像理解函数调用深度推理提示词缓存
2025-10-15
anthropic logo
Anthropic: Claude Sonnet 4.5AnthropicOpenAI
anthropic/claude-sonnet-4-5

Claude Sonnet 4.5 在能力与成本之间取得最佳平衡,推理细腻、代码可靠,并支持 effort 调节,是日常生产的默认之选。

上下文
1M
最大输出
8K
输入
$3/M
输出
$15/M
缓存读取
$0.3/M
缓存写
$3.75/M
对话图像理解函数调用深度推理提示词缓存文件输入
2025-09-29
anthropic logo
Anthropic: Claude Opus 4.1AnthropicOpenAI
anthropic/claude-opus-4-1

Claude Opus 4.1 是 Anthropic 上一代旗舰,擅长复杂推理、长链路工程与高质量写作。200K 上下文配合提示词缓存,适合对质量要求最高的生产任务。

上下文
200K
最大输出
8K
输入
$15/M
输出
$75/M
缓存读取
$1.5/M
缓存写
$18.75/M
对话图像理解函数调用深度推理提示词缓存文件输入
2025-08-05