Google推出Gemini 3.8 Flash,在复杂任务上执行更多推理步骤和迭代工具调用,单价与3.7相同,但高强度模式下实际消耗可能更高。
Google 推出了 Gemini 3.8 Flash,距其前代产品仅隔数周。该公司声称,新模型在复杂任务上执行更多推理步骤、"迭代调用工具",比 Gemini 3.7 Flash "更努力地工作"。它的入门定价与 3.7 Flash 相同,每百万输入 tokens 0.75 美元,每百万输出 tokens 3.75 美元,但用户的实际支出仍可能更高。Google 提示:"模型可能会使用更多 tokens 以最大化性能,尤其是在更高努力级别下。"如果想控制 token 用量,开发者可以继续使用 Gemini 3.7 Flash。
Gemini 3.8 Flash 发布后,网上出现了一些早期评价。Artificial Analysis 重点关注了该模型的定价,称 Gemini 3.8 Flash "是我们所评测过的同 intelligence 级别中最低价的。尽管每 token 价格不变,但相比 Gemini 3.7 Flash 上涨约 40%,原因是每个任务的输出 tokens 增加了 30%,以及在 agentic 评测中增加了更多轮次。"
Aigora.ai CEO John Ennis 将 Gemini 3.8 Flash 与 Anthropic 的模型进行了对比,称它提供了 "Opus 5 的编码质量,但成本仅为其一小部分,而且速度极快",并补充道:"这对于制作 Remotion 视频这类场景来说将会非常棒。"
Google 表示,Gemini 3.8 Flash 在软件工程和 autonomous AI agents 方面实现了"显著改进"。在 DeepSWE v1.1 软件工程基准测试中,它的表现优于其前代产品及其他前沿模型,包括 Anthropic 的 Fable 5——后者本周也进行了升级,同样承诺以更低的价格实现更强性能,方式是降低缓存数据的调用价格。
Google 的新模型在 Vals Finance Agent V2 基准测试和 Harvey's Legal Agent 基准测试中也优于竞争对手。不过,新模型也"配备了针对化学、生物、放射性和核(CBRN)以及网络攻击领域滥用的防护措施。"
Google 同时发布了 Gemini 3.8 Flash Cyber,并推出了新的 Fairwind Program,该计划仅面向政府机构和"可信合作伙伴"。该计划目前已有 650 名成员,包括 CrowdStrike 和互联网安全中心(Center for Internet Security),向成员提供 3.8 Flash Cyber 和 Google 的 CodeMender agent。Google 表示,CodeMender 可以"自主发现并修复漏洞,保护关键基础设施、公共服务和国家安全。"Gemini 3.8 Flash 现已向拥有 Google AI Pro 或 Ultra 订阅的个人用户以及开发者和企业用户开放。