Gemini 3 开发指南发布
Google 发布 Gemini 3 模型供开发者使用,提供新一代 AI 能力,直接改变开发者的工具选择
Google 发布 Gemini 3 模型供开发者使用,提供新一代 AI 能力,直接改变开发者的工具选择
无论你是经验丰富的开发者还是"感觉流"编码者,Gemini 3 都能帮你把任何想法变为现实。
Google AI Studio 和 Gemini API 产品负责人
Google 正在推出 Gemini 3 Pro,这是他们最强大的模型,在 AI 基准测试和编码任务中都超越了先前版本。你可以通过 Google AI Studio 和 Vertex AI 中的 Gemini API 访问它,或者尝试 Google Antigravity 平台进行 Agent 开发。现在就开始构建,并探索其在多模态理解、视觉推理和 vibe coding 中的能力。
"Start building with Gemini 3"介绍了 Google 最强大的模型,可以帮你把任何想法变为现实。
Gemini 3 Pro 超越了先前版本,并在 Agent 工作流和编码任务中表现突出。
你可以在 Google AI Studio、Vertex AI 和像 Google Antigravity 这样的开发工具中使用 Gemini 3 Pro。
该模型开启了"vibe coding"——让你在 Google AI Studio 中用自然语言 prompt 创建应用。
Gemini 3 Pro 在多模态理解、视觉推理和空间推理方面表现出色,可用于各种应用。
今天我们推出 Gemini 3,这是我们最强大的模型,可以帮你把任何想法变为现实。Gemini 3 Pro 基于最先进的推理基础构建,与先前版本相比,在每个主要 AI 基准测试中都取得了无与伦比的成绩。它还在编码上超越了 2.5 Pro,掌握了 Agent 工作流和复杂的零样本任务。
Gemini 3 Pro 能够无缝融入现有的生产 Agent 和编码工作流,同时也能实现之前不可能的新用例。它目前以预览价格提供,对于 200k token 或以下的 prompt,输入 token 价格为 2 美元/百万,输出 token 价格为 12 美元/百万,通过 Gemini API 在 Google AI Studio 和企业级 Vertex AI 中提供(有关速率限制和完整定价详情,请参阅定价页面)。此外,它还可以通过生态系统中你喜欢的开发者工具使用,并在 Google AI Studio 中免费提供(受速率限制)。
开发者越来越多地花时间用 AI 作为助手来创建软件。基于 Gemini 2.5 Pro 的势头和所有反馈,Gemini 3 Pro 成为 Agent 编码模型可能性的新智能基础。
Gemini 3 Pro 在 Terminal-Bench 2.0 上得分 54.2%,该基准测试评估模型通过终端操作计算机的工具使用能力。
你可以在 Google Antigravity(我们新推出的 Agent 开发平台)中感受到这个模型的强大能力,同时也可以在 Gemini CLI、Android Studio 以及像 Cursor、GitHub、JetBrains、Manus、Cline 等其他编码产品中体验。
为了推进模型和 IDE 如何协同工作,我们推出了 Google Antigravity 来展示 Gemini 3 的可能性。这是一个 Agent 开发平台,让开发者能够在更高层级、面向任务的基础上工作,通过跨工作区管理 Agent,同时保留熟悉的 AI IDE 体验。
这是一种更快的开发方式:你充当架构师,与能够跨编辑器、终端和浏览器自主工作的智能 Agent 协作。这些 Agent 规划并执行复杂的软件任务,通过详细的工件向用户传达它们的工作。这提升了开发的所有方面,从构建功能、UI 迭代、修复 bug 到研究和生成报告。访问 Google Antigravity 网站下载公开预览版,现在支持 MacOS、Windows 和 Linux,完全免费。
通过 Gemini 3,我们发布了客户端 bash 工具,让模型能够在 Agent 工作流中提议 shell 命令,用于导航本地文件系统、驱动开发流程和自动化系统操作等任务。我们还配套了用于多语言代码生成和安全原型设计的服务器端 bash 工具。目前在 Gemini API 中面向早期访问合作伙伴提供,通用版本即将推出。
此外,Gemini 托管工具 Grounding with Google Search 和 URL context 现在可以与结构化输出组合使用。这对于构建涉及获取和提取数据然后以特定格式输出供下游 Agent 任务使用的 Agent 用例特别强大。
Gemini 3 Pro 开启了真正的"vibe coding"潜能,其中自然语言是你唯一需要的语法。通过显著改进复杂指令遵循和深度工具使用,该模型能够用单个 prompt 将高层想法转化为完全交互的应用。它处理多步规划和编码细节的繁重工作,提供更丰富的视觉效果和更深层的交互性,让你能专注于创意愿景。
Gemini 3 Pro 在 WebDev Arena 排行榜上排名第一,得分达到令人印象深刻的 1487 Elo。
无论是用单个 prompt 构建游戏、从非结构化语音笔记创建交互式着陆页,还是从餐巾纸草图开发完整应用,开发者都能用 Gemini 3 把想法变为现实。通过这个模型,我们将单 prompt 生成能力推进到了前所未有的程度,这意味着你能从想法一步到位到 AI 驱动的应用,就像在 Google AI Studio 中构建的这款复古游戏一样。
我们构建了 Google AI Studio,作为你从 prompt 到 AI 原生应用的最快路径。Build 模式让你能比以往任何时候都更快地添加 AI 能力,自动连接正确的模型和 API,而像注解这样的功能能实现快速直观的迭代。你现在就可以在 Google AI Studio 中开始用 Gemini 3 构建。
Gemini 3 是世界上处理复杂多模态理解的最佳模型,在复杂图像推理的 MMMU-Pro 和视频理解的 Video MMMU 上创造了新的高度。结合其智能和 100 万 token 的上下文窗口,开发者在构建关键多模态用例时能看到显著的改进。为了让你更好地控制延迟和成本,你现在可以在 Gemini API 中根据应用所需的视觉保真度更精细地配置多模态视觉处理。
Gemini 3 Pro 在文档理解方面是同类最佳,超越简单的 OCR(光学字符识别),能够智能处理复杂的文档理解和推理。
你可以在我们的演示应用中看到模型的视觉理解、推理和编码能力,该应用在 Google AI Studio 中实现想法到现实的转变。
模型改进的空间理解也驱动了在指向、轨迹预测和任务进度等具身推理任务中的强大表现,为自动驾驶汽车、XR 设备和机器人等领域解锁了新用例。
其空间推理还为桌面、移动和 OS 屏幕的智能屏幕理解赋能,为计算机使用 Agent 带来了显著的性能提升。该模型还能根据鼠标移动和屏幕注解理解用户操作的意图,解锁了像这个 Visual Computer 演示应用一样的新颖体验。
Gemini 3 Pro 通过高帧率理解捕捉快速动作,确保开发者不会在快速移动的场景中错过关键时刻。超越速度,长上下文回忆能够合成叙事并在数小时连续片段中精确定位特定细节。
Gemini 3 Pro 已经集成到许多开发者产品和工具中,无缝融入你的现有工作流,并解锁全新的编码方式。
使用 Gemini API 构建:你可以通过 Google AI Studio 和企业级 Vertex AI 立即将 Gemini 3 Pro 集成到你的应用中。为了支持模型更深层的推理能力,我们在 API 中引入了新的思考层级和更精细的媒体分辨率参数,以及对思考签名的更严格验证。这个更新对于在多轮对话中保留模型的思考过程至关重要。查看开发者指南了解技术细节,并参考我们的 Prompting 指南学习如何使用 Gemini 3 Pro 构建。
体验模型的 Agent 能力:无论你是在 Android 应用中添加 AI 原生功能、通过 Gemini CLI 自动化工作流,还是在 Google Antigravity 中管理自主 Agent 集群,Gemini 3 Pro 都提供了复杂 Agent 架构所需的可靠性。
使用 Gemini 3 Pro 进行 vibe coding:Google AI Studio 是你将任何想法变为现实的最快路径。从 Build 模式开始,用单个 prompt 生成完全可用的应用。如果你需要一些灵感,点击"I'm feeling lucky",让 Gemini 3 Pro 同时处理创意灵感和代码实现。
软件格局正在转变。随着 AI 改变谁来构建以及如何构建,我们致力于在你所在的地方与你相遇——为你提供工具来突破可能性的边界。
这只是 Gemini 3 时代的开始,但我们迫不及待地想看到你用 Gemini 3 Pro 构建什么!