前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8356
  • 用属性测试验证 LLM 输出的 JSON Schema
  • 低资源语言的 Prompt 工程实践
  • 英文Prompt在多语言环境下静默失效的根因分析
  • 本地通过的Prompt测试为何在CI中失败:六类根因排查
  • 谁在买SOTA模型?市场数据揭示真实选型逻辑
  • Hugging Face发布开源模型夏季观察报告
  • 测试中固定模型版本:防止静默漂移
  • AI缓存省钱指南:命中/未命中价差最高50倍
  • 固定Mistral模型快照版本实战指南
  • 用Commit Hash固定Llama检查点而非移动标签
  • 固定Grok模型快照版本指南
  • 固定Gemma检查点而非跟踪Main分支
  • 固定Cohere模型版本实战
  • 测试中固定API版本防止无声破坏
  • AI生成电话号码格式的正确处理方式
  • Ollama启动失败:端口11434占用根因与解决
  • Ollama树莓派部署:硬件要求与模型选型指南
  • Ollama并发调优:num_parallel提升吞吐的原理
  • Ollama num_ctx参数:它其实是内存分配而非限制
  • Ollama多模型并行:三个环境变量控制逻辑详解
  • 谷歌发布 Gemini 3.7 Flash:编程与 Agent 专用,半价优惠
  • Agent 记忆不应在聊天中,应在项目文件里
  • 搜索索引前必须对 RTL 文本做五步规范化
  • AI文本水印技术原理解析
  • OpenAI GPT-5.6 Sol 推出 Ultrafast 模式:吞吐提升14倍
  • 浏览器测试中用 MSW Mock OpenAI API 的正确姿势
  • AI Agent 记忆污染与工具劫持风险解析
  • 变形测试:LLM Prompt的测试方法论
  • Chat API消息数组格式深度对比:OpenAI/Anthropic/Gemini
  • 本地部署LoRA:合并与分离的工程权衡
  • LLM 长对话中 KV 缓存的显存开销实测推导
  • 日志模板提取:单遍算法从百万行日志恢复句子结构
  • ML 日志异常检测:模板频率 vs 模板顺序两种检测范式
  • Locust 压测流式接口的坑:响应时间和载荷都测不准
  • 换大模型供应商后 i18n 三处必检点
  • llamafile:下载即跑的跨平台模型可执行文件,一条命令起动推理
  • llama.cpp 服务端并发Slot机制与503处理
  • llama.cpp Slots机制与连续批处理原理
  • llama-server兼容OpenAI API实战指南
  • Lambda 容器镜像部署模型调用实战
  • Lambda 冷启动:Init 时长 vs 模型调用时长的真相
  • Lambda 调用 Bedrock 的 AccessDeniedException 排障
  • K8s GPU 节点池:Taint/Toleration 避坑指南
  • 模型加载慢?K8s 探针配置正确姿势
  • KoboldCpp 上下文切换原理深度解析
  • Provider迁移期间如何避免两套Prompt版本漂移
  • 模型术语差异:Anthropic与OpenAI同名不同义的技术词汇详解
  • ChatGPT Work:桌面自动化、记忆与治理,OpenAI进军AI工作流
  • 流式Chat接口集成测试:压缩、中间件与SSE帧边界的坑
  • Writer基于GLM-5.2开源版推出低成本AI模型
  • AI实现前先写ADR和SDD:让AI在有上下文的条件下做设计决策
  • 已加载 51 / 8356
9.0
重磅
AI SCORE
模型发布2026-08-14 07:30

谷歌发布 Gemini 3.7 Flash:编程与 Agent 专用,半价优惠

IT之家#Gemini#大模型#编程
Editor brief · 编辑速览

Gemini 3.7 Flash 专为编程和 Agent 场景优化,定价仅为前代一半(输入 0.75$/M Token),已接入 Google AI Pro 订阅的 Spark 功能。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

8 月 13 日,谷歌正式发布 Gemini 3.7 Flash 模型,该模型专为编程与 Agents 场景打造。

文章配图

此次发布距 Gemini 3.6 Flash 仅约三周之隔。谷歌表示,新版本的推出直接源于开发者反馈及一系列算法创新。Gemini 3.7 Flash 在软件工程、知识工作及网页开发工作流方面均实现大幅提升。

此外,在今年年底前(截至 2026 年 12 月 31 日),Gemini 3.7 Flash 将以首发优惠价提供(Gemini 3.6 Flash 同样享有该优惠),仅为原 3.6 Flash 每百万 Token 价格的一半:

输入:每百万 Token 0.75 美元(约合 5.1 元人民币)

输出:每百万 Token 3.75 美元(约合 25.3 元人民币)

文章配图

即日起,Gemini Spark 将正式接入 Gemini 3.7 Flash,面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户开放。本次升级显著提升了 Spark 处理知识工作的效率,优化了其对 Google Workspace 系列应用工具的调用能力,从而为复杂且跨技能的综合工作流提供更高的准确度与更高质量的输出。

此外,Gemini 3.7 Flash 推出了全新的安全防御机制,在严防化学、生物、放射性及核(CBRN)领域和网络攻击滥用的同时,确保合法且有益的应用场景得以顺利实施。

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
Ollama多模型并行:三个环境变量控制逻辑详解
下一篇
Agent 记忆不应在聊天中,应在项目文件里