
Gemini API(Google AI Studio) 是谷歌官方的 Gemini 模型开发平台,2026 年当前主力模型线为 Gemini 3.1 Pro Preview(旗舰)、Gemini 3 Flash(默认)、Gemini 3.1 Flash-Lite(最便宜)。支持 Google GenAI SDK、REST API,Batch API 全模型 5 折,Context Caching 命中低至 $0.0125/MTok(Flash-Lite)。Gemini 3 Flash / 3.1 Flash-Lite 保留免费额度(有每日/每分钟限流),Pro 模型自 2026 年 4 月 1 日起取消免费档、仅付费 。国内直连受限,需VPN(国区受限)。
产品概述
Google 于 2023 年 12 月推出 Gemini API(原 Bard API 升级),2024 年 Gemini 1.5 系列将上下文推到 1M-2M,2025 年 Gemini 2.5 Pro 树立”长上下文+推理”标杆,2026 年 4 月 1 日重大调整——Pro 模型全面转为付费,Flash/Flash-Lite 保留缩减版免费额度;2026 年 6 月 Gemini 3.1 Pro Preview 正式可用,2M 上下文窗口为当前生产环境最大,定价 $2/$12 与 GPT-5.4 持平、仅为 Claude Opus 4.8($5/$25)的 40% 。Gemini 3 Flash 成为新的默认模型($0.50/$3.00),Gemini 3.1 Flash-Lite 以 $0.25/$1.50 成为一线厂商最便宜的主流模型 。可通过 Google AI Studio 网页端直接调试,或通过 Vertex AI 企业级部署。
核心能力
- 文本生成:Gemini 3.1 Pro / 3 Flash / 3.1 Flash-Lite 全档通用对话、写作、代码、翻译
- 推理:Gemini 3.1 Pro 在 SWE-bench、多步推理基准上对标 GPT-5.4 / Claude Opus 4.8
- 长上下文:Gemini 3.1 Pro 2M token 上下文窗口,为 2026 年生产环境最大(Claude Opus 4.8 为 1M,GPT-5.4 为 270K)
- 多模态:原生多模态——文本/图像/视频/音频统一输入,Imagen 3 文生图(免费层 100 张/天)
- 高级功能:Context Caching(Flash-Lite 命中 $0.0125/MTok,90% 折扣)、Batch API 5 折、Tool Use、JSON Output、Google Search Grounding($14/千次查询)、TTS 语音合成
优势亮点
- 2M 上下文窗口:生产环境最长,一次性处理整本代码仓库/长篇论文/全卷书籍,碾压同级
- 旗舰定价友好:Gemini 3.1 Pro $2/$12 与 GPT-5.4 持平,仅为 Claude Opus 4.8 的 40%
- Flash/Flash-Lite 保留免费额度:2026 年唯一仍有一线厂商免费层的平台(Claude 仅 $5 试用,OpenAI 仅 $5 赠金)
- Context Caching 极致优化:Flash-Lite 命中 $0.0125/MTok,长 prompt 场景成本极低
- Batch API 5 折,适合离线大批量任务
- 原生多模态:文本/图像/视频/音频统一输入,Imagen 3 文生图、TTS 语音合成一体化
- Google Search Grounding 接地能力,实时信息检索
- 可通过 Vertex AI 企业部署,满足合规与安全需求
短板
- 国内需VPN(国区受限):Google 服务在中国大陆不可直连
- 2026 年 4 月 1 日起 Pro 模型取消免费额度,仅 Flash/Flash-Lite 保留缩减版免费额度
- 模型迭代极快:Gemini 系列版本跳跃大(2.0→2.5→3→3.1),老代码迁移成本高,Gemini 2.0 Flash 已于 2026 年 6 月 1 日停服
- 编程能力略逊 Claude Opus 4.8 / Fable 5(SWE-bench 排名第二梯队)
- 免费层有严格限流:Flash 系列 5 请求/分钟、全模型 100 请求/天
- 账户需海外手机号+信用卡,国内用户注册门槛高
适用人群
海外开发者、需要处理超长文档/代码仓库的场景、预算敏感且需要长上下文的项目、多模态应用开发者。国内用户需通过 Vertex AI 或合规中转平台调用。
相关导航


n1n

百度千帆

TokenHub

OpenRouter

Together AI

阶跃星辰 API

