官方模型接入准备目录

按供应商、能力、状态查看模型功能、官方计费和接入边界

返回接入说明
状态说明:16 个生产候选已经登记为关闭路由;只有录入官方 Key、确认积分、完成真实请求验证并由管理员启用后,才会出现在可调用模型中。预览、限制开放和退役模型仍只保留资料。国产模型不经过本网关,需在业务工具中直连厂商官方接口。目录核查日期:2026-08-08。

当前已开放模型

Google Gemini 官方已开放

Gemini 3.5 Flash

gemini-3.5-flash

持续代理执行和复杂多模态工作的高能力 Flash 模型。

文字与多模态理解代码、复杂流程、工具调用和多模态运营分析
Google Gemini 官方已开放

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite

Google 当前低成本、高吞吐生产模型。

文字与多模态理解翻译、抽取、分类、结构化 JSON 和大批量轻任务
Google Gemini 官方已开放

Gemini 3.6 Flash

gemini-3.6-flash

面向复杂代理、多模态理解、代码和空间推理的高速主力模型。

文字与多模态理解日常多模态分析、Agent、代码、长文档和高质量批处理
OpenAI 官方已开放

GPT-5.5

gpt-5.5

上一代复杂专业工作模型,保留用于兼容和效果对照

文字与多模态理解既有 GPT-5.5 工作流、迁移对照、兼容备用
OpenAI 官方已开放

GPT-5.6 Luna

gpt-5.6-luna

面向高频和高吞吐任务的轻量高效模型

文字与多模态理解翻译、分类、字段提取、批量预处理
OpenAI 官方已开放

GPT-5.6 Sol

gpt-5.6-sol

旗舰专业推理模型,适合复杂分析、代码和质量优先任务

文字与多模态理解复杂专业分析、重要报告、难题推理
OpenAI 官方已开放

GPT-5.6 Terra

gpt-5.6-terra

兼顾能力、速度和成本的均衡模型

文字与多模态理解日常运营分析、内容生成、批量专业任务
Google Gemini 官方已开放

Gemini Embedding 001

gemini-embedding-001

成熟的文字向量模型。

向量化文字知识库、搜索、聚类和推荐
Google Gemini 官方已开放

Gemini Embedding 2

gemini-embedding-2

支持文字、图片、音频和视频的统一多模态向量。

向量化知识库、跨模态检索、相似商品和内容去重
Google Gemini 官方已开放

Gemini 2.5 Flash Image

gemini-2.5-flash-image

Nano Banana,适合高吞吐、低延迟的原生图片生成与编辑。

图片生成与编辑快速商品图、对话式改图和低成本创意任务
Google Gemini 官方已开放

Gemini 3 Pro Image

gemini-3-pro-image

Nano Banana Pro,强调上下文理解、设计质量和高分辨率。

图片生成与编辑高质量电商主图、复杂改图、文字排版和终稿
Google Gemini 官方已开放

Gemini 3.1 Flash Image

gemini-3.1-flash-image

Nano Banana 2,高速交互式图片生成与编辑。

图片生成与编辑商品图、改图、批量高质量图片任务
Google Gemini 官方已开放

Gemini 3.1 Flash Lite Image

gemini-3.1-flash-lite-image

Nano Banana 2 Lite,低延迟、低成本图片生成和编辑。

图片生成与编辑大量预览图、低成本批量改图和方案草图
OpenAI 官方已开放

GPT Image 2

gpt-image-2

已通过新度模型 API 网关开放调用。

图片生成与编辑
OpenAI 官方已开放

GPT Image 2.5 Flare

gpt-image-2.5-flare

OpenAI 快速高质量日常图片生成与编辑模型

图片生成与编辑批量电商图、快速方案测试、日常生图与改图
OpenAI 官方已开放

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

OpenAI 当前能力最强的图片生成与精确编辑模型

图片生成与编辑高质量电商图、复杂改图、商品细节与构图控制
OpenAI 官方已开放

OpenAI Sora 2

sora-2

OpenAI 图生视频与文生视频模型,支持同步音频

视频生成720p 快速方案测试、短视频镜头生成
OpenAI 官方已开放

OpenAI Sora 2 Pro

sora-2-pro

OpenAI 高质量图生视频与文生视频模型,支持同步音频

视频生成画面稳定性和细节优先的高质量营销素材
Google Gemini 官方已开放

Veo 3.1 Fast

veo-3.1-fast-generate-001

Veo 3.1 的高速版本。

视频生成快速短视频、批量方案测试和预览
Google Gemini 官方已开放

Veo 3.1

veo-3.1-generate-001

Google 高质量视频生成模型。

视频生成质量优先的视频成片和关键广告镜头
Google Gemini 官方已开放

Veo 3.1 Lite

veo-3.1-lite-generate-001

Veo 3.1 的低成本轻量版本,支持原生音频。

视频生成低成本批量视频和早期创意验证

官方模型候选目录

当前显示 26 个模型。价格均来自各供应商官方公开页面;没有统一公开价格的模型明确标为“控制台实时报价”。

Google Gemini生产候选

Gemini 3.6 Flash

gemini-3.6-flash

面向复杂代理、多模态理解、代码和空间推理的高速主力模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片、视频、音频、PDF 输入 / 文字输出
上下文
1,048,576 输入 / 65,536 输出
推荐用途
日常多模态分析、Agent、代码、长文档和高质量批处理
官方计费
标准:输入 1.50 / 缓存输入 0.15 / 输出 7.50 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 3.5 Flash

gemini-3.5-flash

持续代理执行和复杂多模态工作的高能力 Flash 模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片、视频、音频、PDF 输入 / 文字输出
上下文
1,048,576 输入 / 65,536 输出
推荐用途
代码、复杂流程、工具调用和多模态运营分析
官方计费
标准:输入 1.50 / 缓存输入 0.15 / 输出 9.00 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite

Google 当前低成本、高吞吐生产模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片、视频、音频输入 / 文字输出
上下文
1,048,576 输入 / 65,536 输出
推荐用途
翻译、抽取、分类、结构化 JSON 和大批量轻任务
官方计费
标准:输入 0.30 / 缓存输入 0.03 / 输出 2.50 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini 3.1 Pro Preview

gemini-3.1-pro-preview

高性能多模态理解、代理与代码预览模型。

能力
文字与多模态理解
网关状态
暂未登记
输入输出
文字、图片、视频、音频、PDF 输入 / 文字输出
上下文
1,048,576 输入 / 65,536 输出
推荐用途
高难推理、复杂视觉理解和模型对照测试
官方计费
不超过 200K:输入 2.00 / 缓存 0.20 / 输出 12.00;超过 200K:4.00 / 0.40 / 18.00 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini 3.1 Pro Custom Tools

gemini-3.1-pro-preview-customtools

针对复杂自定义工具调用优化的 3.1 Pro 预览变体。

能力
文字与多模态理解
网关状态
暂未登记
输入输出
文字、图片、视频、音频、PDF 输入 / 文字输出
上下文
1,048,576 输入 / 65,536 输出
推荐用途
工具密集型 Agent 和复杂业务编排测试
官方计费
与 Gemini 3.1 Pro Preview 相同,长上下文分档计费

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini 3.1 Flash Live

gemini-3.1-flash-live-preview

低延迟音频到音频实时对话,并支持多模态感知。

能力
语音与音频
网关状态
暂未登记
输入输出
文字、图片、视频、音频输入 / 文字、音频输出
上下文
Live API 限制以官方文档为准
推荐用途
实时语音助手、通话和低延迟交互
官方计费
输入:文字 0.75、音频 3.00、图片/视频 1.00;输出:文字 4.50、音频 12.00 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini 3.5 Live Translate

gemini-3.5-live-translate-preview

支持 70 多种语言的低延迟语音到语音翻译。

能力
语音与音频
网关状态
暂未登记
输入输出
音频输入 / 翻译音频输出
上下文
以官方控制台为准
推荐用途
跨语言实时通话、直播和客服翻译
官方计费
音频输入约 0.0053 美元/分钟,音频输出约 0.0315 美元/分钟

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 3.1 Flash Image

gemini-3.1-flash-image

Nano Banana 2,高速交互式图片生成与编辑。

能力
图片生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字、图片输出
上下文
以官方控制台为准
推荐用途
商品图、改图、批量高质量图片任务
官方计费
输入 0.50;文字/思考输出 3.00;图片输出 60.00 美元,每百万 Token;约 0.067 美元/1K 图

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 3.1 Flash Lite Image

gemini-3.1-flash-lite-image

Nano Banana 2 Lite,低延迟、低成本图片生成和编辑。

能力
图片生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字、图片输出
上下文
以官方控制台为准
推荐用途
大量预览图、低成本批量改图和方案草图
官方计费
输入 0.25;文字/思考输出 1.50;图片输出 30.00 美元,每百万 Token;约 0.0336 美元/1K 图

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 3 Pro Image

gemini-3-pro-image

Nano Banana Pro,强调上下文理解、设计质量和高分辨率。

能力
图片生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字、图片输出
上下文
以官方控制台为准
推荐用途
高质量电商主图、复杂改图、文字排版和终稿
官方计费
输入 2.00;文字/思考输出 12.00;图片输出 120.00 美元,每百万 Token;约 0.134 美元/1K 或 2K 图

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini 2.5 Flash Image

gemini-2.5-flash-image

Nano Banana,适合高吞吐、低延迟的原生图片生成与编辑。

能力
图片生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字、图片输出
上下文
以官方控制台为准
推荐用途
快速商品图、对话式改图和低成本创意任务
官方计费
输入 0.30 美元/百万 Token;图片输出约 0.039 美元/张

Google 已建议新任务优先使用 Nano Banana 2 Lite;本模型仍按真实模型 ID 保留。

查看官方资料
Google Gemini预览测试

Gemini Omni Flash Preview

gemini-omni-flash-preview

下一代视频生成和编辑预览模型。

能力
视频生成与编辑
网关状态
暂未登记
输入输出
文字、图片、视频、音频输入 / 文字、视频输出
上下文
以官方控制台为准
推荐用途
视频生成、视频编辑和多模态视频实验
官方计费
输入 1.50;文字输出 9.00;视频输出 17.50 美元,每百万 Token,720p 约 0.10 美元/秒

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Veo 3.1

veo-3.1-generate-001

Google 高质量视频生成模型。

能力
视频生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 视频输出
上下文
以官方控制台为准
推荐用途
质量优先的视频成片和关键广告镜头
官方计费
按 Gemini Developer API 当前生效价目表及生成视频时长计费

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Veo 3.1 Fast

veo-3.1-fast-generate-001

Veo 3.1 的高速版本。

能力
视频生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 视频输出
上下文
以官方控制台为准
推荐用途
快速短视频、批量方案测试和预览
官方计费
按 Gemini Developer API 当前生效价目表及生成视频时长计费

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Veo 3.1 Lite

veo-3.1-lite-generate-001

Veo 3.1 的低成本轻量版本,支持原生音频。

能力
视频生成与编辑
网关状态
已登记待启用
输入输出
文字、图片输入 / 视频和音频输出
上下文
以官方控制台为准
推荐用途
低成本批量视频和早期创意验证
官方计费
按 Gemini Developer API 当前生效价目表及生成视频时长计费

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini 3.1 Flash TTS

gemini-3.1-flash-tts-preview

低延迟、可控的文字转语音模型。

能力
语音与音频
网关状态
暂未登记
输入输出
文字输入 / 音频输出
上下文
以官方控制台为准
推荐用途
短视频口播、播报和多语言配音
官方计费
文字输入 1.00 / 音频输出 20.00 美元,每百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Lyria 3 Clip

lyria-3-clip-preview

生成约 30 秒音乐片段。

能力
音乐生成
网关状态
暂未登记
输入输出
文字输入 / 音乐输出
上下文
以官方控制台为准
推荐用途
短视频背景音乐和音乐方案预览
官方计费
0.04 美元/次

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Lyria 3 Pro

lyria-3-pro-preview

生成完整音乐作品。

能力
音乐生成
网关状态
暂未登记
输入输出
文字输入 / 音乐输出
上下文
以官方控制台为准
推荐用途
完整背景音乐和品牌音乐实验
官方计费
0.08 美元/次

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini Embedding 2

gemini-embedding-2

支持文字、图片、音频和视频的统一多模态向量。

能力
向量化
网关状态
已登记待启用
输入输出
文字、图片、音频、视频输入 / 向量输出
上下文
以官方控制台为准
推荐用途
知识库、跨模态检索、相似商品和内容去重
官方计费
文字 0.20 美元/百万 Token;图片约 0.00012 美元/张;音频 0.00016 美元/秒;视频 0.00079 美元/帧

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini生产候选

Gemini Embedding 001

gemini-embedding-001

成熟的文字向量模型。

能力
向量化
网关状态
已登记待启用
输入输出
文字输入 / 向量输出
上下文
以官方控制台为准
推荐用途
文字知识库、搜索、聚类和推荐
官方计费
文字输入 0.15 美元/百万 Token

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Google Gemini预览测试

Gemini Robotics ER 2 Streaming

gemini-robotics-er-2-streaming-preview

用于机器人实时具身推理的双向流式视觉语言模型。

能力
机器人具身推理
网关状态
暂未登记
输入输出
文字、图片、视频、音频输入 / 流式文字输出
上下文
以官方控制台为准
推荐用途
机器人、实体设备和实时动作研究
官方计费
官方页面未给统一公开刊例,接入前读取控制台报价

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Anthropic Claude生产候选

Claude Fable 5

claude-fable-5

Anthropic 当前能力最高且广泛开放的长程 Agent 模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字输出
上下文
1M 输入 / 128K 输出
推荐用途
最高质量长任务、深度研究、复杂 Agent 和高难推理
官方计费
输入 10 / 缓存命中 1 / 输出 50 美元,每百万 Token;5 分钟缓存写入 12.5,1 小时写入 20

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Anthropic Claude限制开放

Claude Mythos 5

claude-mythos-5

与 Fable 5 规格和价格相同的限制开放模型。

能力
文字与多模态理解
网关状态
暂未登记
输入输出
文字、图片输入 / 文字输出
上下文
1M 输入 / 128K 输出
推荐用途
经批准的防御性网络安全工作流
官方计费
输入 10 / 缓存命中 1 / 输出 50 美元,每百万 Token

仅 Project Glasswing 批准客户可用,不进入普通自助接入计划。

查看官方资料
Anthropic Claude生产候选

Claude Opus 5

claude-opus-5

复杂代理式编码和企业知识工作的高能力模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字输出
上下文
1M 输入 / 128K 输出
推荐用途
复杂代码、长任务、企业文档、视觉和电脑操作
官方计费
输入 5 / 缓存命中 0.5 / 输出 25 美元,每百万 Token;5 分钟缓存写入 6.25,1 小时写入 10

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料
Anthropic Claude生产候选

Claude Sonnet 5

claude-sonnet-5

速度与智能平衡的 Claude 生产主力模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字输出
上下文
1M 输入 / 128K 输出
推荐用途
代码、运营分析、内容、工具调用和视觉理解
官方计费
2026-08-31 前介绍价:输入 2 / 输出 10 美元;之后标准价:输入 3 / 输出 15 美元,每百万 Token

新 tokenizer 对相同文本可能产生约 30% 更多 Token,必须以实际 usage 校验成本。

查看官方资料
Anthropic Claude生产候选

Claude Haiku 4.5

claude-haiku-4-5-20251001

Claude 当前最快、低成本且具备较强推理能力的模型。

能力
文字与多模态理解
网关状态
已登记待启用
输入输出
文字、图片输入 / 文字输出
上下文
200K 输入 / 64K 输出
推荐用途
实时应用、高吞吐、分类、轻量子 Agent
官方计费
输入 1 / 缓存命中 0.1 / 输出 5 美元,每百万 Token;5 分钟缓存写入 1.25,1 小时写入 2

接入前需配置官方 Key,并完成真实请求、计费和并发验证。

查看官方资料

供应商接入参数

供应商官方 Base URL协议服务器密钥变量适配要求
Google Geminihttps://generativelanguage.googleapis.com/v1beta/openaiOpenAI 兼容;高级能力使用 Google 原生协议GEMINI_API_KEY生产候选已按官方 OpenAI 兼容入口登记;高级工具、Live API 和预览模型继续使用原生协议单独验证。
Anthropic Claudehttps://api.anthropic.com/v1Anthropic 官方 OpenAI 兼容协议ANTHROPIC_API_KEY生产候选已按 Anthropic 官方 OpenAI 兼容层登记;高级缓存、原生思考块和完整 Messages 能力后续单独扩展。

机器可读工程清单:/catalog.json。该清单不包含任何 API Key。