8.0
热点
AI SCORE
模型发布2026-09-16 02:23
Google发布Gemini 3.8 Live语音模型,价格仅为GPT-Live-1的零头
The Decoder#Google#Gemini#语音模型
Editor brief · 编辑速览
Gemini 3.8 Live及扩展思考版本登顶语音转语音基准测试,每小时语音对话成本1.38美元,显著低于OpenAI的GPT-Live-1定价。
Google DeepMind 发布了 Gemini 3.8 Live 和 3.8 Live Extended Thinking,两款面向开发者的新型音频模型,可通过 Gemini API 和 Google AI Studio 获取。Gemini 3.8 Live 为语音代理提供动力,能够在后台发起 API 调用、处理视觉输入,同时保持对话流畅。该模型支持超过 97 种语言。Extended Thinking 变体在 Artificial Analysis Speech-to-Speech 排行榜上以 82.6% 的成绩位居第一,领先于 OpenAI 最新的 GPT-Live-1 系列模型。示例应用已发布在 GitHub 上。
Google 对音频输入收取每分钟 0.005 美元、输出收取每分钟 0.018 美元,远低于 OpenAI GPT-Live-1 的每分钟 0.05 美元。使用 Google 进行一小时的语音对话成本约 1.38 美元,而 OpenAI 至少需要 3.00 美元。OpenAI 的模型凭借全双工(full duplex)能力——能够同时听和说——仍应提供更自然的对话体验。从演示来看,其音质也更好,这表明 Google 再次选择了以价格换质量的策略。
无炒作的 AI 新闻 — 人工筛选
订阅 THE DECODER,享受无广告阅读、每周 AI 通讯、每年六期的独家"AI Radar"前沿报告、完整档案访问权及评论区参与权限。