Google AI Studio 开发体验升级
Google 公布 AI Studio 的新功能改进,包括界面优化和开发流程增强,值得使用 Google AI 工具的开发者关注。
Google 公布 AI Studio 的新功能改进,包括界面优化和开发流程增强,值得使用 Google AI 工具的开发者关注。
原生代码生成、Agent 工具,以及更多新功能
Google AI Studio 是使用 Gemini API 开始构建应用最快捷的平台,你可以在这里使用我们能力最强的模型,包括 Gemini 2.5 预览版模型,以及 Imagen、Lyria RealTime 和 Veo 等生成式媒体模型。在 Google I/O 上,我们发布了一系列新功能,帮助你构建和部署完整的应用,同时还带来了新的模型能力和 Google Gen AI SDK 新特性。
Gemini 2.5 Pro 的编程能力非常出色,因此我们很高兴将它引入 Google AI Studio 的原生代码编辑器。它针对我们的 Gen AI SDK 进行了深度优化,让你只需输入简单的文本、图片或视频 prompt,就能更轻松地生成应用。全新的 Build 标签页现已成为你快速构建和部署 AI Web 应用的入口。我们还推出了新的示例应用,方便你体验新模型及更多功能。
抱歉,你的浏览器不支持播放此视频
除了通过单个 prompt 生成应用之外,你还可以通过对话继续迭代 Web 应用。你可以进行修改、查看 diff,甚至回到之前的检查点以撤销编辑。
抱歉,你的浏览器不支持播放此视频
你还可以一键将这些新创建的应用部署到 Cloud Run。
抱歉,你的浏览器不支持播放此视频
Google AI Studio 应用及其生成的代码使用一种特殊的占位 API key,使 Google AI Studio 能够代理所有 Gemini API 调用。因此,当你通过 Google AI Studio 分享应用时,其用户产生的所有 API 使用量都会计入他们各自在 Google AI Studio 中的免费使用额度,完全不会消耗你自己的 API key 和配额。你可以在我们的 FAQ 中了解更多信息。
该功能目前仍处于实验阶段,因此在对外分享项目之前,你应始终检查生成的代码。我们的一次性生成功能目前主要针对 Gemini 和 Imagen 模型进行了优化,对更多模型和工具调用的支持即将推出。
我们一直在努力以更快的速度,将 Google DeepMind 先进的多模态模型带入开发者的工具箱。全新的 Generate Media 页面集中提供 Imagen、Veo、具备原生图片生成能力的 Gemini,以及新的原生语音生成模型,方便开发者发现和使用。此外,你还可以通过 Google AI Studio 内置的 PromptDJ 应用,体验 Lyria RealTime 带来的交互式音乐生成。
YouTube 视频链接(仅在禁用 JS 时可见)
Gemini 2.5 Flash 原生音频对话功能现已在 Live API 中开放预览。该模型现在可以生成更加自然的响应,并支持 30 多种声音。我们还加入了主动音频功能,使模型能够区分说话者与背景对话,从而判断何时应该响应。借助这些能力,你可以构建体验更直观、更自然的对话式 AI Agent 和相关应用。
YouTube 视频链接(仅在禁用 JS 时可见)
除 Live API 外,我们还发布了支持原生音频输出的 Gemini 2.5 Pro 和 Flash 文本转语音(TTS)预览版。现在,你可以生成单说话者或多说话者音频,并灵活控制表达风格。
YouTube 视频链接(仅在禁用 JS 时可见)
你可以在 Stream 标签页中体验 Live API 的原生音频功能,也可以通过 Generate Speech 体验新的 TTS 能力。
Google Gen AI SDK 现在也原生支持 Model Context Protocol(MCP)定义,可以更轻松地与日益丰富的开源工具集成。我们还提供了一个演示应用,展示如何在 Google AI Studio 中使用 MCP server,将 Google Maps 与 Gemini API 结合起来。
URL Context 是一种新的实验性工具,让模型能够检索并引用你所提供链接中的内容。它非常适合用于事实核查、内容比较、总结以及深度研究。
抱歉,你的浏览器不支持播放此视频
我们非常高兴能将所有这些更新带到 Google AI Studio,使其成为开发者探索和使用 Google 最新模型进行构建的平台。
从 5 月 22 日开始,你可以在 io.google 上了解本次发布内容以及 Google I/O 2025 的全部更新。
多模态生成