Gemini 3.5 Flash
gemini-3.5-flash持续代理执行和复杂多模态工作的高能力 Flash 模型。
按供应商、能力、状态查看模型功能、官方计费和接入边界
gemini-3.5-flash持续代理执行和复杂多模态工作的高能力 Flash 模型。
gemini-3.5-flash-liteGoogle 当前低成本、高吞吐生产模型。
gemini-3.6-flash面向复杂代理、多模态理解、代码和空间推理的高速主力模型。
gpt-5.5上一代复杂专业工作模型,保留用于兼容和效果对照
gpt-5.6-luna面向高频和高吞吐任务的轻量高效模型
gpt-5.6-sol旗舰专业推理模型,适合复杂分析、代码和质量优先任务
gpt-5.6-terra兼顾能力、速度和成本的均衡模型
gemini-embedding-001成熟的文字向量模型。
gemini-embedding-2支持文字、图片、音频和视频的统一多模态向量。
gemini-2.5-flash-imageNano Banana,适合高吞吐、低延迟的原生图片生成与编辑。
gemini-3-pro-imageNano Banana Pro,强调上下文理解、设计质量和高分辨率。
gemini-3.1-flash-imageNano Banana 2,高速交互式图片生成与编辑。
gemini-3.1-flash-lite-imageNano Banana 2 Lite,低延迟、低成本图片生成和编辑。
gpt-image-2已通过新度模型 API 网关开放调用。
gpt-image-2.5-flareOpenAI 快速高质量日常图片生成与编辑模型
gpt-image-2.5-sunburstOpenAI 当前能力最强的图片生成与精确编辑模型
sora-2OpenAI 图生视频与文生视频模型,支持同步音频
sora-2-proOpenAI 高质量图生视频与文生视频模型,支持同步音频
veo-3.1-fast-generate-001Veo 3.1 的高速版本。
veo-3.1-generate-001Google 高质量视频生成模型。
veo-3.1-lite-generate-001Veo 3.1 的低成本轻量版本,支持原生音频。
当前显示 26 个模型。价格均来自各供应商官方公开页面;没有统一公开价格的模型明确标为“控制台实时报价”。
gemini-3.6-flash面向复杂代理、多模态理解、代码和空间推理的高速主力模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.5-flash持续代理执行和复杂多模态工作的高能力 Flash 模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.5-flash-liteGoogle 当前低成本、高吞吐生产模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-pro-preview高性能多模态理解、代理与代码预览模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-pro-preview-customtools针对复杂自定义工具调用优化的 3.1 Pro 预览变体。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-flash-live-preview低延迟音频到音频实时对话,并支持多模态感知。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.5-live-translate-preview支持 70 多种语言的低延迟语音到语音翻译。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-flash-imageNano Banana 2,高速交互式图片生成与编辑。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-flash-lite-imageNano Banana 2 Lite,低延迟、低成本图片生成和编辑。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3-pro-imageNano Banana Pro,强调上下文理解、设计质量和高分辨率。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-2.5-flash-imageNano Banana,适合高吞吐、低延迟的原生图片生成与编辑。
Google 已建议新任务优先使用 Nano Banana 2 Lite;本模型仍按真实模型 ID 保留。
查看官方资料gemini-omni-flash-preview下一代视频生成和编辑预览模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料veo-3.1-generate-001Google 高质量视频生成模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料veo-3.1-fast-generate-001Veo 3.1 的高速版本。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料veo-3.1-lite-generate-001Veo 3.1 的低成本轻量版本,支持原生音频。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-3.1-flash-tts-preview低延迟、可控的文字转语音模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料lyria-3-clip-preview生成约 30 秒音乐片段。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料lyria-3-pro-preview生成完整音乐作品。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-embedding-2支持文字、图片、音频和视频的统一多模态向量。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-embedding-001成熟的文字向量模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料gemini-robotics-er-2-streaming-preview用于机器人实时具身推理的双向流式视觉语言模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料claude-fable-5Anthropic 当前能力最高且广泛开放的长程 Agent 模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料claude-mythos-5与 Fable 5 规格和价格相同的限制开放模型。
仅 Project Glasswing 批准客户可用,不进入普通自助接入计划。
查看官方资料claude-opus-5复杂代理式编码和企业知识工作的高能力模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料claude-sonnet-5速度与智能平衡的 Claude 生产主力模型。
新 tokenizer 对相同文本可能产生约 30% 更多 Token,必须以实际 usage 校验成本。
查看官方资料claude-haiku-4-5-20251001Claude 当前最快、低成本且具备较强推理能力的模型。
接入前需配置官方 Key,并完成真实请求、计费和并发验证。
查看官方资料| 供应商 | 官方 Base URL | 协议 | 服务器密钥变量 | 适配要求 |
|---|---|---|---|---|
| Google Gemini | https://generativelanguage.googleapis.com/v1beta/openai | OpenAI 兼容;高级能力使用 Google 原生协议 | GEMINI_API_KEY | 生产候选已按官方 OpenAI 兼容入口登记;高级工具、Live API 和预览模型继续使用原生协议单独验证。 |
| Anthropic Claude | https://api.anthropic.com/v1 | Anthropic 官方 OpenAI 兼容协议 | ANTHROPIC_API_KEY | 生产候选已按 Anthropic 官方 OpenAI 兼容层登记;高级缓存、原生思考块和完整 Messages 能力后续单独扩展。 |
机器可读工程清单:/catalog.json。该清单不包含任何 API Key。