Google 扩展 Gemini 产品线:推出更快更便宜的 3.6 Flash 和 3.5 Flash-Lite 用于 agent 工作,Token 效率提升 17%,同时发布 Gemini Robotics 2 用于物理任务。
Google 正在同时从两个方向扩展 Gemini:一方面,为软件开发和企业工作流提供速度更快、成本更低的模型;另一方面,推出面向具身智能和跨机器人控制的新机器人模型家族。此次发布的产品包括 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber,以及 Gemini Robotics 2 及其相关的具身推理和端侧变体。
对于企业而言,最直观的变化是 Agent 工作可选择的模型越来越丰富。在 Gemini Flash 的官方发布公告中,Google 将 3.6 Flash 定位为适用于编程、知识工作和多模态任务的通用主力模型,而 3.5 Flash-Lite 则面向那些将响应速度和成本效率视为决定性因素的工作负载。机器人领域的更新进一步将这一整体战略从软件 Agent 延伸到必须理解物理环境并在其中采取行动的系统。
Gemini 3.6 Flash 已通过 Google 的开发者、企业和消费者渠道全面开放。Google 表示,与 3.5 Flash 相比,它在编程、知识工作和多模态任务方面均有所提升,同时生成的输出 token 数量减少约 17%。这一 token 效率指标非常重要,因为在多步骤 Agent 工作流中,输出 token 是影响延迟和推理成本的重要因素。
Google 公布的 Gemini 3.6 Flash 定价为:每 100 万输入 token 1.50 美元,每 100 万输出 token 7.50 美元。Google 称该模型能够实现更低的单任务成本,而这一指标不仅取决于 token 单价,也取决于完成一项任务所需要的 token 数量。现有发布信息并未提供 3.5 Flash-Lite 的价格,因此不能依据 3.6 Flash 的定价对其进行推断。
Gemini 3.5 Flash-Lite 承担的是另一种角色。Google 称它是旗下速度最快、成本效益最高的子系列,官方给出的输出速度为每秒 350 个输出 token。它面向高吞吐量的 Agent 工作流:在这类场景中,相比 3.6 Flash 更全面的主力模型定位,企业可能更看重模型的快速响应能力和较高的请求处理量。
不同模型之间的开放范围差异值得关注。3.6 Flash 和 3.5 Flash-Lite 已在 Gemini 生态系统内广泛开放,包括 Gemini App、Gemini Enterprise App、Gemini Enterprise Agent Platform、Google AI Studio、Gemini API 和 Google Antigravity。相比之下,3.5 Flash Cyber 仅面向政府机构和受信任的合作伙伴开展有限试点。Google 还表示,Gemini 3.5 Pro 正在与合作伙伴进行测试,并未将其描述为已经广泛开放。
对于技术团队来说,实际决策的重点并不是选出唯一的“最佳”模型,而是根据工作流的经济性和风险特征匹配合适的模型:
Gemini 3.6 Flash 是通用选择,适用于同时涉及编程、侧重推理的知识工作和多模态输入的任务。
Gemini 3.5 Flash-Lite 面向高速、大规模的 Agent 操作。
Gemini 3.5 Flash Cyber 是一种访问受限的专业能力,这也体现出漏洞发现和修复具有更高的风险。
正在评估这些方案的企业可以与 Scalevise 合作,制定 AI 架构、工作流自动化和集成计划,将模型选择与真实的业务运营需求联系起来。
Google DeepMind 此次发布的机器人模型并不只是又一个文本或代码模型。Gemini Robotics 2 属于一个具身 AI 模型家族,其中还包括 Gemini Robotics ER 2 和 Gemini Robotics On-Device 2。Google 表示,该模型家族能够为人形机器人及其他机器人提供全身智能和跨具身控制能力。
这一定位所对应的部署挑战与传统企业 AI 截然不同。软件 Agent 可以通过 API 和工具运行,而机器人必须将感知、推理、运动以及物理身体的约束连接起来。跨具身控制尤其值得关注,因为它表明其目标可能是在多种机器人形态上应用同一套智能能力,而不是将系统限制在某一种机器设计中。
这套机器人产品已经上线,DeepMind 的专属页面展示了相关演示,并开放了早期访问候补名单。现有材料并未表明 Gemini Robotics 2、Gemini Robotics ER 2 或 Gemini Robotics On-Device 2 已全面开放,也没有提供其商业定价。对于企业来说,这次更新是观察 Google 在物理 AI 领域发展方向的重要信号,但目前还不能据此认定这些机器人能力可以采用与已全面开放的 Flash 模型相同的访问方式进行部署。
综合来看,这些新产品表明 Google 正在构建一个细分程度更高的 Gemini 产品组合。Flash 模型聚焦于企业普遍关心的速度、token 使用量、工具驱动型工作流以及部署覆盖范围。机器人模型家族则着眼于更长远的需求:将多模态推理能力带入能够直接与物理世界交互的系统。二者的共同主线,是让 Gemini 能够支持越来越多样化的 Agent 形态——从软件工作流一直延伸到机器人。
Gemini 3.6 Flash 是 Google 已全面开放的主力模型,适用于编程、知识工作和多模态任务。Google 的定价为每 100 万输入 token 1.50 美元,每 100 万输出 token 7.50 美元。
Google 将 3.5 Flash-Lite 定位为旗下速度最快、成本效益最高的子系列,适用于高速 Agent 工作流,输出速度最高可达每秒 350 个 token。Gemini 3.6 Flash 的定位则更加广泛,主要面向编程、知识工作和多模态任务。
Google 表示,这两款模型已通过 Gemini App、Gemini Enterprise App、Gemini Enterprise Agent Platform、Google AI Studio、Gemini API 和 Google Antigravity 全面开放。Google 还特别提到,3.5 Flash-Lite 已集成到 Google Search 中。
Gemini Robotics 2 模型家族已经上线,并开放了早期访问候补名单,但现有信息尚未确认其已全面开放,也没有公布商业定价。
Google 对 Gemini 的更新让不同 AI 工作负载之间的分工变得更加清晰。Gemini 3.6 Flash 和 3.5 Flash-Lite 为企业和开发者工作流提供了具有不同性能侧重点、且已广泛开放的选择,而 Gemini Robotics 2 则将整个计划扩展到具身智能领域。短期内的关键问题在于,企业如何将不断扩大的模型选择范围,转化为可靠、治理得当的软件和机器人部署。
如需采取进一步行动,你可以考虑屏蔽此人和/或举报其滥用行为。