官方文档实时同步型号:
Gemini 3.8 FlashGemini 3.8 LiveGemini 3.8 Live Extended ThinkingGemini 3.7 FlashGemini 3.6 FlashGemini 3.5 FlashGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite

最新版本与功能更新记录

按官方发版时间倒序排列 (消费 releases.json)
旗舰全模态 2026-09 窗口:1,000,000+ Tokens

Gemini 3.8 Flash & Live 系列

Google 官方最新一代主力模型,支持超低首字延迟交互、全双工 Live 音视频流及 Extended Thinking 深度思考分支。

生产力基准 2026-08 窗口:1,000,000 Tokens

Gemini 3.7 Flash & 3.5 Flash 系列

高吞吐低单价的主力生产推理模型,多模态长文本记忆衰减率显著降低,复杂代码生成评测表现优异。

深度推理 2026-07 窗口:2,000,000 Tokens

Gemini 3.1 Pro (深度推理实验分支)

面向长程科研、Agent 自动化执行与极限数学推理的超大容量模型,原生支持达 200 万 token 混合上下文。

主流 Gemini 系列模型上下文规格参考

Google AI Studio / Vertex AI 核心配置
模型标识 最大上下文窗口 多模态音画能力 当前可用度
Gemini 3.8 Flash 1M tokens 原生超低延迟全双工音画流 全面可用
Gemini 3.8 Live 1M tokens 实时双向语音视频流交互 全面可用
Gemini 3.1 Pro 2M tokens 超长上下文视听多模态解析 预览阶段
Gemini 3.5 Flash-Lite 1M tokens 极速轻量端云协同推理 全面可用
Gemini 2.5 系列 2M tokens 成熟长期稳定生产环境支持 全面可用