Gemini 3.1 Flash Image(Nano Banana 2)通过对话即可生成与编辑图像,支持多分辨率与多种宽高比,适合创意生成与图像编辑。
Claude Opus 4.8 是 Anthropic 当前最强的通用模型,具备一流的推理、代码与 Agent 能力,配合百万上下文胜任最具挑战的端到端任务。
Gemini 3.5 Flash 是 Google 高性价比的主力多模态模型,擅长快速推理、长上下文与代码,百万级上下文适合规模化日常任务。
Gemini 3.1 Flash-Lite 是 Gemini 家族中最轻量、最低成本的层级,响应快、单价极低,适合高频对话与大规模轻量任务。
GPT-5.5 是 OpenAI 的旗舰前沿模型,深度长上下文推理与可靠的 agentic 执行,105 万 token 上下文,经 Azure OpenAI 提供。
Claude Opus 4.7 是 Anthropic 的高自主性旗舰,专为复杂工程与长链路工作设计,在多步推理与长输出中表现稳定。
GPT-5.4 Nano 是最快最省的档位,面向高吞吐的分类、抽取与排序类负载,40 万 token 上下文,经 Azure OpenAI 提供。
GPT-5.4 Mini 是低延迟、低成本的均衡型号,适合大规模日常任务与子代理,40 万 token 上下文,经 Azure OpenAI 提供。
Gemini Embedding 2 是 Google 原生多模态向量模型,支持文本、图像等输入,可调维度(默认 3072),适合检索、聚类与 RAG。
GPT-5.4 Pro 面向最高难度任务的深度推理档,仅经 Responses API(/v1/responses)提供,105 万 token 上下文,经 Azure OpenAI 提供。
GPT-5.4 是 OpenAI 的高性价比主力前沿模型,多步推理与 agentic 能力兼备,105 万 token 上下文,经 Azure OpenAI 提供。
Claude Sonnet 4.6 延续 Sonnet 系列的高性价比,百万上下文与缓存让长会话更经济,适合规模化的日常任务。
GLM-5 是智谱最新旗舰,在中文理解、推理与多模态任务上表现出色,具备视觉与函数调用能力,原生中文优化使其在国内业务中尤为可靠。
Claude Opus 4.6 将上下文扩展到百万级,在大型代码库、长文档与长链路 Agent 场景中保持卓越的连贯性。
GLM-4.7 Flash 是 GLM 系列的轻量极速版本,响应快、成本极低,适合高频对话与轻量任务。
GLM-4.7 是 GLM 系列的高性价比主力,擅长中文对话与函数调用,在成本敏感的规模化场景中稳定可靠。
Claude Opus 4.5 在保持顶级能力的同时大幅下调价格,并引入 effort 调节以平衡质量与成本。适合高自主性 Agent 与复杂多步任务。
Claude Haiku 4.5 是 Claude 家族中速度最快、成本最低的成员,延迟极低却保留可靠的推理与视觉能力,适合实时交互与高频调用。
Claude Sonnet 4.5 在能力与成本之间取得最佳平衡,推理细腻、代码可靠,并支持 effort 调节,是日常生产的默认之选。
Claude Opus 4.1 是 Anthropic 上一代旗舰,擅长复杂推理、长链路工程与高质量写作。200K 上下文配合提示词缓存,适合对质量要求最高的生产任务。