谷歌 Gemini 3 Flash:性价比新选择
Google 发布 Gemini 3 Flash,兼具前沿智能与成本优势。为开发者提供更经济的 AI 模型选项,改变工具栈选择。
Google 发布 Gemini 3 Flash,兼具前沿智能与成本优势。为开发者提供更经济的 AI 模型选项,改变工具栈选择。
Gemini 3 Flash 是我们最新发布的模型,具有为速度而优化的前沿智能,可以帮助每个人更快地学习、构建和规划任何东西。
产品管理高级总监,代表 Gemini 团队
Google 正在发布 Gemini 3 Flash,一个为速度优化的快速、经济高效的模型。你现在可以通过 Gemini 应用和搜索中的 AI Mode 访问 Gemini 3 Flash。开发者可以通过 Gemini API、Google AI Studio、Google Antigravity、Gemini CLI、Android Studio、Vertex AI 和 Gemini Enterprise 访问它。
Gemini 3 Flash 提供 Pro 级别的推理能力,具有 Flash 级别的速度和更低的成本。
它适合编码、复杂分析和交互应用中的快速问答。
Gemini 3 Flash 现在是 Gemini 应用和搜索中 AI Mode 的默认模型。
开发者和日常用户可以通过多个 Google 平台访问 Gemini 3 Flash。
今天,我们通过发布 Gemini 3 Flash 来扩展 Gemini 3 模型家族,它以极低的成本提供为速度优化的前沿智能。通过此次发布,我们使 Gemini 3 的下一代智能能够为所有 Google 产品中的每个人所用。
上个月,我们以 Gemini 3 Pro 和 Gemini 3 Deep Think 模式推出了 Gemini 3,反响异常热烈。自发布以来,我们的 API 每天处理超过 1 万亿个 token。我们看到你们使用 Gemini 3 进行编码模拟来学习复杂主题、构建和设计交互游戏,以及理解各种多模态内容。
借助 Gemini 3,我们在复杂推理、多模态和视觉理解以及 Agent 和编码任务方面引入了前沿性能。Gemini 3 Flash 在此基础之上,结合了 Gemini 3 的 Pro 级别推理能力与 Flash 级别的延迟、效率和成本。它不仅能够以更强的推理能力完成日常任务,还是我们在 Agent 工作流中最令人印象深刻的模型。
从今天开始,Gemini 3 Flash 正在向全球数百万用户推出:
对于开发者,通过 Gemini API、Google AI Studio、Gemini CLI 和我们新的 Agent 开发平台 Google Antigravity
对于所有用户,通过 Gemini 应用和搜索中的 AI Mode
对于企业,通过 Vertex AI 和 Gemini Enterprise
Gemini 3 Flash 证明速度和规模不必以牺牲智能为代价。它在博士级别推理和知识基准上展现了前沿性能,例如 GPQA Diamond(90.4%)和 Humanity's Last Exam(33.7%,不使用工具),可与更大的前沿模型相媲美,并在许多基准上明显优于最好的 2.5 模型 Gemini 2.5 Pro。它在 MMMU Pro 上也达到了最先进的性能,得分为 81.2%,与 Gemini 3 Pro 相当。
除了其前沿级别的推理和多模态能力外,Gemini 3 Flash 被设计为高效率的模型,推动了质量与成本和速度的帕累托前沿。在最高思考级别处理时,Gemini 3 Flash 能够调节其思考深度。对于更复杂的用例,它可能需要更长的思考时间,但在典型流量测量下,平均使用的 token 比 2.5 Pro 少 30%,以更高的性能准确完成日常任务。
Gemini 3 Flash 在性能与成本和速度之间推动了帕累托前沿。
这里的性能由 LMArena Elo 得分衡量。
Gemini 3 Flash 的优势在于其原始速度,建立在开发者和用户已经喜爱的 Flash 系列之上。它在性能上优于 2.5 Pro,同时速度快 3 倍(基于 Artificial Analysis 基准测试),成本仅为其一小部分。Gemini 3 Flash 的定价为输入 token 每百万个 $0.50,输出 token 每百万个 $3(音频输入仍为输入 token 每百万个 $1)。
Gemini 3 Flash 在速度和质量上优于 2.5 Pro。
Gemini 3 Flash 为迭代开发而设计,提供 Gemini 3 的 Pro 级别编码性能和低延迟——它能够在高频工作流中快速推理和解决任务。在 SWE-bench Verified(用于评估编码 Agent 能力的基准)上,Gemini 3 Flash 达到了 78% 的得分,不仅优于 2.5 系列,还优于 Gemini 3 Pro。它为 Agent 编码、生产就绪系统和响应式交互应用提供了理想的平衡。
Gemini 3 Flash 在推理、工具使用和多模态能力方面的强劲表现,对于希望执行更复杂的视频分析、数据提取和视觉问答的开发者来说是理想的,这意味着它可以支持更智能的应用——例如游戏内助手或 A/B 测试实验——这些应用既需要快速答案,又需要深度推理。
Gemini 3 Flash 在手部追踪的"球体启动拼图游戏"中提供多模态推理,提供近乎实时的 AI 辅助。
Gemini 3 Flash 以近乎实时的方式构建并 A/B 测试新的加载旋转器设计,简化了设计到代码的流程。
Gemini 3 Flash 使用多模态推理分析和标注图像,并提供上下文 UI 覆盖,近乎实时地将静态图像转变为交互式体验。
Gemini 3 Flash 根据单一指令提示生成三个独特的设计变体。
我们从使用 Gemini 3 Flash 的公司获得了巨大反响。JetBrains、Bridgewater Associates 和 Figma 等公司已经在使用它来改造他们的业务,认可其推理速度、效率和推理能力与更大型模型的性能相当。Gemini 3 Flash 从今天起通过 Vertex AI 和 Gemini Enterprise 向企业提供。
Gemini 3 Flash 现在是 Gemini 应用中的默认模型,取代了 2.5 Flash。这意味着我们全球所有 Gemini 用户都将免费获得 Gemini 3 体验,为他们的日常任务带来重大升级。
由于 Gemini 3 Flash 具有令人难以置信的多模态推理能力,你可以使用它更快地帮助你看到、听到和理解任何类型的信息。例如,你可以要求 Gemini 理解你的视频和图像,并在短短几秒钟内将该内容转化为有帮助和可行动的计划。
Gemini 应用中的 Gemini 3 Flash 可以分析短视频内容并给你一个计划,例如如何改进你的高尔夫挥杆。
由于 Gemini 3 Flash 为速度优化,它可以在你仍在绘制草图时看到并猜测你在绘制什么。
你可以上传音频录音,Gemini 3 Flash 将识别你的知识差距,创建自定义测验,并给你答案的详细解释。
或者你可以使用你的声音从头开始快速构建有趣、有用的应用,无需先前的编码知识。只需在途中向 Gemini 口述,它可以在几分钟内将你的非结构化想法转化为功能应用。
Gemini 3 Flash 也开始作为搜索中 AI Mode 的默认模型推出,全球所有人都可以访问。
基于 Gemini 3 Pro 的推理能力,具有 Gemini 3 Flash 的 AI Mode 在解析问题细微差别方面更强大。它会考虑查询的每个方面,以提供深思熟虑、全面的响应,这些响应在视觉上易于理解——从网络各地提取实时本地信息和有用链接。结果有效地结合了研究和即时行动:你得到一个智能组织的分解,以及具体的建议——以搜索的速度。
这在处理具有多个考虑因素的复杂目标时表现出色,例如尝试规划临时旅行或快速学习复杂的教育概念。
Gemini 3 Flash 现已通过 Gemini API、Google AI Studio、Google Antigravity、Vertex AI 和 Gemini Enterprise 预览版提供。你也可以通过其他开发者工具(如 Gemini CLI 和 Android Studio)访问它。它也开始向 Gemini 应用和搜索中的 AI Mode 中的所有人推出,为所有人免费提供对下一代智能的快速访问。
我们期待看到你们用这个扩展的模型家族——Gemini 3 Pro、Gemini 3 Deep Think 和现在的 Gemini 3 Flash——创造出什么。