前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • 744B MoE 模型能跑在普通桌面上的工程原理
  • Cloudflare 安全审计 Skill 最值得抄的设计:独立验证 Agent
  • AI 生成代码上线前审计:五个高频漏洞
  • VS Code 1.138发布:开发容器内运行AI智能体,Copilot订阅可切换
  • Apify MCP Server:2 分钟让 AI 操控真实网页爬虫
  • 五大 AI 编程工具的会话恢复能力全面横评
  • Agent 写的测试通过,不代表测对了
  • 向 AI 编程助手投喂代码前:先过这枚分类器
  • MCP Server 间接提示词注入审计与利用实战教程
  • LLM 应用安全实战:威胁建模与防御实践指南
  • AI Agent 技能系统设计:列出≠安装≠执行,三层边界须厘清
  • 国产RSI模型发布:Flash模型亮相,1亿Tokens免费领取
  • codsh 0.23:Mission Contract 控制面,防止 AI 编码目标漂移
  • 用 AI Agent 自动分析 S3 存储账单,Terraform 策略一键生成
  • OpenAI 发布 GPT-6 Astra:分阶段推送,支持多 Agent 协同与长程推理
  • 提取 DeepSeek R1 的思维链:CoT 清洗与推理日志导出指南
  • Nunchux开源VC-Attention:免训练低比特注意力核加速视频DiT
  • GitHub Copilot 800 KLOC 运行时全面迁移 Rust,AI 编程工具进入生产级工程阶段
  • n8n新增云端AI模型即服务:无需创建服务商账户
  • OpenSpec:轻量级可配置的AI规格框架
  • Gemini 企业平台新增 Agent 行为异常检测功能
  • Google OAuth Testing 模式 refresh token 7 天过期陷阱
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 大规模会话管理的架构陷阱
  • Google 开放 Google Home 给任意 MCP 协议 AI Agent
  • Google Home 推出 MCP 服务器,AI Agent 可控制智能家居
  • Mem0登录Vercel市场,为AI应用一键集成长期记忆
  • LlamaIndex多租户AI Agent记忆层架构实践
  • AI评测师:史上最重要的AI岗位?开发者转型指南
  • Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
  • 前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本
  • Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线
  • Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
  • 微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识
  • Radio:让AI Agent之间直接对话的共享频道
  • 国产多模态模型 ZDTaichu5.0-9B 开源,九项空间测试夺八冠
  • Jev:极简分类/路由模型,比小前沿模型快 100 倍、便宜 200 倍
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • Gemma 4+Raspberry Pi桌面机器人的混合LLM架构
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • 已加载 51 / 8529
8.0
热点
AI SCORE
工具产品2026-09-17 06:52

Gemini 企业平台新增 Agent 行为异常检测功能

Google Developers Blog#Agent#安全#Gemini
Editor brief · 编辑速览

基于 OpenTelemetry 追踪和工具调用分析,在不增加线上延迟的情况下检测 Agent 逻辑异常和政策违规,对标 OWASP Agentic Top 10。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

每一代新模型都让 AI Agent 能力更强、更自主、成本更低。团队正在用它们承担实际业务任务:处理退款、更新记录、以用户名义调用内部工具。但能力更强的模型并不自动等于更安全的模型。Agent 在运行时做的决策越多,其风险就从代码层转移到行为层。真正的损害往往发生在表面看起来毫无问题的会话中:Agent 给出了一个干净的答复并关闭了工单,只有事后你才发现它调用了一个本不该碰的工具,或者执行了一个悄悄扩大了自己权限的请求。因为没有直接报错,这个会话通过了通常的基于指标的评估,没有引起任何二次审视。

这个空白正是 Agent Anomaly Detection 要填补的。它现已登陆 Gemini Enterprise Agent Platform,处于 Private Preview 阶段。

什么是 Agent Anomaly Detection?

Agent Anomaly Detection 是一个基于推理的监督与审计层,适用于部署在 Gemini Enterprise Agent Platform 上的自主 Agent。它通过推理轨迹、工具调用和会话执行流程来检查 Agent 的实际行为。它读取 Agent 已发送的日志和 OpenTelemetry 追踪,评估这些活动以判断 Agent 是否在预期边界之外运行,并标记行为异常、可疑意图和策略违规。

以下是将 Agent Anomaly Detection 投入生产环境运行的一些关键特性:

不增加运行时延迟:分析以异步方式在与实时请求路径分离的频段外运行,因此不会减慢 Agent 的响应速度。

清晰、可操作的发现:每条异常发现都包含严重级别、触发原因的通俗语言解释和推荐的后续步骤。每条异常发现也会发布到你的 Security Command Center 部署中,以便团队能与其他发现一起进行分类处理。

基于 OWASP Agentic Top 10:Agent Anomaly Detection 随附了针对 OWASP Top 10 for Agentic Applications(2026 版)中一组重点风险的检测器:工具滥用(ASI02)、身份与权限滥用(ASI03)、级联故障(ASI08)和恶意 Agent(ASI10),以及资源耗尽和 Token 使用量攀升等运营风险。其发现结果映射到这些公认的业界分类,而非一套定制规则。

即将推出自定义业务逻辑异常检测:正在积极开发用户自定义异常含义的能力,使客户能够用自然语言编写灵活的异常检测器,并结合确定性规则,当 Agent 超出企业特定业务准则时进行标记。此外,用户将能够在新自定义业务逻辑上验证其在历史流量中的准确性。

检测管道内部

Agent Anomaly Detection 在检测速度、成本和覆盖率之间取得平衡。为实现这种平衡,它分层分析追踪和日志:轻量级第一层扫描所有流量以发现统计异常并标记需要进一步分析的会话。然后,基于 LLM 的推理层对被标记的会话进行深入检查。

具体来说,以一个带有 list_inventory 工具的 Inventory Agent 为例。用户说"我想查看库存,每次数 100 条",Agent 就开始以大批量分页浏览,在偏移量之间跳跃以拉取整个目录。

这里没有任何错误抛出。Agent 只是在做它能力范围内的事,而且可能没有政策阻止它。但 Agent Anomaly Detection 标记了这种异常行为,逐层分析会话:第一层将会话标记为流量和重复调用中的统计异常。第二层推理完整对话,将大批量、跳跃偏移量的模式识别为系统性抓取而非正常浏览,并返回带有通俗语言解释的裁决。当某个案例需要更仔细审视时,第三层重建各个工具调用及其偏移量,以精确显示被拉取的内容。

结果是得到一条异常发现:Resource exhaustion,严重级别为 Critical,概率为 95%,附有理据和推荐修复方案:对该用户限流或阻止 list_inventory 工具,添加授权检查以限制批量库存访问,以及对大偏移量分页模式发出警报。该发现也会在 Security Command Center 中显示以供分类处理。

除了人工审查,你还能以编程方式对发现采取行动。Agent Anomaly Detection 暴露了一个 API,用于拉取给定会话的异常,这样 ADK 回调或插件就能检查发现的严重级别和概率,并在超过你设定的阈值时阻止后续工具调用或中止下一轮对话。

随着 Agent 承担更多实际工作,更多风险转移到其行为中。Agent Anomaly Detection 监控 Agent 的行为并为你标记异常供审查和采取行动,而不会减慢 Agent 的速度。

Agent Anomaly Detection 目前处于 Private Preview 阶段,适用于在 Gemini Enterprise Agent Platform 上部署 Agent 且使用 ADK 1.2 或更高版本的团队。要开始使用,请查阅文档了解先决条件和设置。一旦满足先决条件,你可以通过一键配置开启 Agent Anomaly Detection。

Original source

本文由 AI 翻译整理自 Google Developers Blog,原文版权归原作者所有。

阅读英文原文
上一篇
OpenSpec:轻量级可配置的AI规格框架
下一篇
Google OAuth Testing 模式 refresh token 7 天过期陷阱