独立评测机构 Artificial Analysis 数据显示,Gemini 3.6 Flash(免费)得 50 分,Gemini 3.1 Pro($19.99/月)仅 46 分,且 3.6 Flash 输出 token 效率还高 17%。
46 对 50。这不是笔误,也不是误差范围——这是独立实验室 Artificial Analysis 的两份 Intelligence Index 数据,它们颠覆了 Gemini 应用中模型切换器的逻辑。"成年"版 Gemini 3.1 Pro Preview 得 46 分。而"小弟"版 Gemini 3.6 Flash 得 50 分,且仍然处于免费档位,"Pro"在应用中则需通过每月 $19.99 的 Google AI Pro 订阅才能开启。Artificial Analysis 关于 Gemini 3.6 Flash 的数据直接记录了这一点,没有关于测试版的附加说明。如果你在应用中按"重要任务用 Pro"的思路选模型,2026 年 7 月这是一个错误的启发式——且错误的代价不抽象:要么为更弱的模型多付订阅费,要么在一个本不需要 Pro 的任务上翻车。
7 月 21 日,Google 一篇帖子同时将 3.5 Flash 替换为 3.6 Flash,并在一旁发布了 Gemini 3.5 Flash-Lite 和专精型 3.5 Flash Cyber(用于搜索漏洞)。Google 官方公告给出了具体数字:3.6 Flash 完成相同任务少消耗 17% 的输出 token,价格从 $9 降到 $7.50/百万 token,输入为 $1.50/百万 token。很多人至今仍在搜索框里输入的"gemini 3.5 vs 3.1 pro"公式已经过时一代:现在要比较的已经不是 3.5,而是 3.6 Flash——对标的还是那个原地没动的 3.1 Pro。
7 月的核心混淆:应用切换器上写的是"Pro",但背后是上一代模型 Gemini 3.1 Pro。真正的 Gemini 3.5 Pro 尚未发布。Google DeepMind 产品管理高级总监 Tulsee Doshi 的表述很中性:"Gemini 3.5 Pro is currently testing with partners and we plan to make it broadly available as soon as it's ready"——正在与合作伙伴测试,我们计划在准备好后广泛开放,没有给出日期。TechCrunch 引述的 Bloomberg 信源描述同样的停顿更为直白:据 TechCrunch 引 Bloomberg 所述,该模型在代码和复杂推理方面未达到内部目标指标——TechCrunch 关于未附带 3.5 Pro 的发布的报道直接称这是计划延误,而非计划中的打磨。官方措辞"正在与合作伙伴测试"与"未完成内部计划"版本之间的差异,就是"请等待"和"重新制定策略"的差异,这也解释了为什么 7 月 21 日三款模型的发布几乎没有任何事件型公告,只是一篇博客文章:按 TechCrunch 的解读,这是旗舰模型延迟期间试图用速度和价格守住市场份额的尝试。
3.5 Pro 困在合作伙伴测试环节期间,你应用里的"Pro"选项就是 3.1 Pro。而它按复合智能指数,客观上弱于名义上低一档的模型。
3.6 Flash 的加速是真实的,但不在默认寻找的地方。独立基准测试 Artificial Analysis 直言:"Gemini 3.6 Flash does not improve in intelligence over 3.5 Flash"——两款模型的智能指数相同,都是 50 分。提升在速度:据 Artificial Analysis 关于加速一倍的模型的文章,Flash 完成典型任务时间从 2.7 分钟降至 1.3 分钟,Flash-Lite 从 1.0 分钟降至 0.6 分钟。同时 tech-insider.org 等科技评论员写的是"智能提升 12 点"——这个分歧值得明确记录:营销层面的发布解读和独立测试说的是两回事,本例中测试是对的,标题是错的。
加速在实际场景中有体感的领域——代码和 Agent 链。GitHub 已经将 3.6 Flash 接入 Copilot(Pro、Pro+、Max、Business、Enterprise 计划),记录到相比 3.5 Flash 更高的任务完成率和更好的 token 效率——GitHub 关于 Copilot 可用该模型的变更日志没有给出精确的提升百分比,但记录了默认模型替换这一事实。这就是反驳"智能指数没涨"观点的答案:复合分数没涨,但对于具体一类任务——代码、Agent 工作流,这里重要的是迭代速度而非单次回答的深度——更快更便宜的模型连同价格一起胜出,而非在价格面前败下阵来。
3.6 Flash 的上下文窗口仍维持在约 100 万 token 水平,知识截止日期从 2025 年 1 月移至 2026 年 3 月——9to5Google 在发布报道中证实了这一点。精确数值 1,048,576 token 不在这篇文章里,而出现在单独的第三方模型规格汇总表中;Google 官方帖子根本没有提及上下文大小。请将此作为限制条件记住:关于窗口和输出限制的数字来自聚合类博客,而非来自一份统一的官方表格——在发布日期,Google 并没有这样一份表格。

2026 年 4 月起,Pro 级别模型已从 API 免费档中移除——这个数字的来源是 Apiyi 博客关于免费档收紧的文章,没有关联到 Google 自身的某个带日期的页面,所以请将精确的 RPM 限制视为参考,而非保证。实际这意味着:要在应用中访问"Pro",需要每月 $19.99 的付费 Google AI Pro 订阅,且限制不是固定每日请求数,而是计算预算,每 5 小时刷新至周上限——这是 9to5Google 在 Google AI 费率解析中描述的机制。更早期的 2025 年 11 月观察还记录了回退原则本身:当 Pro 模型的免费限额用尽时,应用会静默将回答切换到更弱的 Flash 模型,没有明确提示——PhoneArena 关于 Gemini 3 Pro 限制的文章证实了这一机制,尽管其中具体数字已过时且属于上一代。
单独说明图片问题:在 3.6 Flash、3.5 Flash-Lite 和 3.1 Pro 之间选择,并没有一个单独选项能将这个切换器变成图片生成器。关于当前 Flash 模型多模态输入的数据——文本、图片、视频、音频、PDF——和文本输出来自第三方规格汇总,而非 Google 的统一官方表格;所以这个结论更应视为菜单的限制,而非模型的完整护照。图片生成是独立的产品线,不是这个菜单里的选项。
智能指数是数学、代码和知识的平均复合分,它不能保证在你的具体任务上排名相同,尤其是长篇俄语文档:针对这三款模型的独立俄语质量测试找不到。独立观察者 Meng Li 描述 3.6 Flash 的实际使用体验比任何基准测试都更直白:"The real-world experience has been a tale of two extremes"——根据场景不同结果是两极的,而非明确的改善。这是单个作者的轶事观察,但它恰恰指向复合指数沉默的区域:具体任务类型比费率名称更重要。
如果你根本不确定 Gemini 是否是你任务的正确选择,想在同一 prompt 下比较它与其他模型的回答而不重写集成,有一条直接的路:provod.ai 提供对可用模型目录的统一 API 访问,要在不同供应商之间切换来比较自己任务上的质量,只需在支持 OpenAI 协议的客户端中更换 base URL 和 key——无需重写代码。
这个故事的另一个实际痛点是付款。访问 Gemini 应用中的"Pro"需要每月 $19.99 的 Google AI Pro 订阅,且需要外国信用卡和外币兑换。对于团队——如果内部 AI 工具需要一个可预测的卢布账单而不用反复核算汇率——provod.ai 接受来自俄罗斯的卢布支付:俄罗斯银行卡、通过 СБП 或向法人开票,无需必须使用外国银行卡或 VPN。

如果任务是代码或 Agent 工作流:选 3.6 Flash,它的默认地位不是营销出来的,而是 Copilot 集成事实和每 token 价格支撑的。如果任务是批量处理简单请求,速度和价格比深度更重要:Flash-Lite,$0.30 对比 $1.50/百万输入 token——输入成本比 Flash 便宜五倍,输出便宜三倍。如果任务按老习惯需要"最强"模型——先查智能指数:3.1 Pro 在这上面输给了 3.6 Flash,这种情况下付费订阅的额外开销买的不是更聪明的回答,而只是一个名字。"Pro"这个名字本身合理的唯一情形——是等待真正的 3.5 Pro 发布,而不是接受当前切换器里用 3.1 Pro 的替代品。
provod.ai — 从创意和文本到图片、视频和音频
在不切换数十个服务的情况下完成内容生产流程:剧本、视觉、视频、音乐和音频使用统一的控制台、API 和团队余额。
在一个目录中有文本和媒体的最新模型:OpenAI 的 GPT、Anthropic 的 Claude、Google 的 Gemini、xAI 的 Grok、DeepSeek、Qwen、GLM、Kimi 和 MiniMax;图片方面——Nano Banana 2 Pro 和 GPT Image;视频方面——最新版本的 Seedance、Kling、Veo 和 Google Omni。也可使用 reasoning、搜索、文档、嵌入、音乐和音频模型。
每种格式按供应商的基本价格 1:1 计费:provod.ai 合并结算,但不额外加价。
在 provod.ai 上构建媒体生产:注册表单 · 模型价格 · 按 152-ФЗ 数据保护 · provod.ai 首页
Google 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 发布的官方公告
GitHub 关于 3.6 Flash 接入 Copilot 的变更日志
TechCrunch 关于 Gemini 3.5 Pro 未随发布的相关报道
9to5Google 的模型发布解析
9to5Google 的 Google AI Plus、Pro 和 Ultra 费率解析
Artificial Analysis 关于产品线速度提升一倍的模型的文章
Artificial Analysis 上 Gemini 3.6 Flash 的对比页面
Apiyi 博客关于 Gemini API 免费档收紧的文章
PhoneArena 关于 Gemini 3 Pro 访问限制的报道
aidisruption.ai 上 Meng Li 关于 3.6 Flash 发布的评论
DeepMind 关于专精型 Gemini 3.5 Flash Cyber 模型的博客