前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • GitHub Copilot 800 KLOC 运行时全面迁移 Rust,AI 编程工具进入生产级工程阶段
  • n8n新增云端AI模型即服务:无需创建服务商账户
  • OpenSpec:轻量级可配置的AI规格框架
  • Gemini 企业平台新增 Agent 行为异常检测功能
  • Google OAuth Testing 模式 refresh token 7 天过期陷阱
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 大规模会话管理的架构陷阱
  • Google 开放 Google Home 给任意 MCP 协议 AI Agent
  • Google Home 推出 MCP 服务器,AI Agent 可控制智能家居
  • Mem0登录Vercel市场,为AI应用一键集成长期记忆
  • LlamaIndex多租户AI Agent记忆层架构实践
  • AI评测师:史上最重要的AI岗位?开发者转型指南
  • Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
  • 前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本
  • Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线
  • Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
  • 微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识
  • Radio:让AI Agent之间直接对话的共享频道
  • 国产多模态模型 ZDTaichu5.0-9B 开源,九项空间测试夺八冠
  • Jev:极简分类/路由模型,比小前沿模型快 100 倍、便宜 200 倍
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • Gemma 4+Raspberry Pi桌面机器人的混合LLM架构
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • Pi Agent:统一多模型 LLM API 的 AI 编程 Agent 工具链
  • LibreChat v0.8.8 RC:ChatGPT 克隆支持 Agent 管理 API
  • LandingAI 文档智能抽取 Gen2:原子级引用+按字符计费
  • 不用向量数据库做个人 RAG:grep 级检索也够用
  • Claude Code vs Cursor:按任务场景选择 AI 编程工具的完整指南
  • 2026 年五大主流模型生产选型指南
  • Agent 记忆层测试:六条真正能发现腐化的断言
  • Agent 生成的限流器如何绕过多租户隔离测试
  • 周末 Agent 项目攻略:用permit文件管控写操作
  • squash-merge 后 HEAD~1 指向无关代码的 Agent bug 分析
  • Vibe coding安全指南:防止AI应用密钥泄露
  • AI 生成的 Schema 变更:别让自由派 Diff 绕过锁
  • AI 写的代码编译过了,但环境变量、锁文件、日志全踩坑
  • Skild AI S1:仅凭一段视频,机器人学会翻煎饼
  • Java 27 发布:后量子 TLS 与对象头压缩等 9 项 JEP
  • DeepSeek 算子负责人自述:AI 一年内从查文档到独立优化 CUDA 算子
  • 编程任务 LLM 大模型盲测:4 款模型代码质量实测
  • 已加载 51 / 8529
8.0
热点
AI SCORE
编程提效2026-09-16 23:58

AI评测师:史上最重要的AI岗位?开发者转型指南

The New Stack#AI评测师#职业发展#AI安全
Editor brief · 编辑速览

Anthropic CEO Dario Amodei呼吁设立AI评测师新职业,本文探讨开发者如何填补这一角色——负责评估模型安全性、能力边界与潜在风险。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

前沿 AI 模型开发的速度,促使 Anthropic CEO Dario Amodei 在上周末发表了一篇文章,呼吁业界在监管和发展方式上做出改变。在这份包含民主协作与全球协调的三部分计划中,Amodei 写道,第一步是 Anthropic 承诺单方面采取的行动。

"每个前沿 AI 公司[应该]承诺,持续向一支类似员工的嵌入式第三方评估团队(如 METR)提供访问权限,他们的职责是验证安全实践和承诺的遵守情况、报告事件,并帮助评估的不仅是已完成的 AI 模型,还包括训练管道和流程本身的对齐状况,"Amodei 写道。

Amodei 的文章发表之前,前 Anthropic 和 OpenAI 预训练研究专家 Jacob Coxon 在 X 上发布了一系列警告,称构建 AI 的人们真心"相信它可以在本十年内杀死我们所有人"。

Amodei 发表文章后不久,OpenAI CEO Sam Altman 和 SpaceX AI 创始人 Elon Musk 也加入了讨论:"我同意 Dario 的观点",Altman 发帖说;"Dario 是对的",Musk 发帖说。当天晚些时候,Google DeepMind 创始人 Demis Hassabis 发帖称:"Dario 的文章指向了正确的道路。"Meta CEO Mark Zuckerberg 在 X 上发帖称,Meta Superintelligence Labs 已经使用独立评估人员,并表示:"总的来说,有一个更大、更多元化的评估者生态系统会更有帮助。"

本周,外界开始猜测为什么全球最大的前沿 AI 实验室会在竞争如此激烈的情况下有意放慢步伐。"想要放慢速度令人费解,但也许如果整个系统都慢下来,获胜的规则对所有人来说都一样了,"Palo Alto Networks 董事长兼 CEO Nikesh Arora 发帖称。

在其文章中,Amodei 将提议的独立 AI 评估人员工作比作银行业使用的嵌入式监管督导,即第三方专业人员。Altman 在 X 上的发帖中将该工作描述为拥有"类似员工的访问权限"。

那么,这个 AI 领袖们一致认为迫切需要的角色,究竟由谁来担任呢?

薪资高达 68.7 万美元,你有兴趣吗?

METR 目前的职位空缺薪酬丰厚(薪资最高可达约 68.7 万美元),职位要求也令人望而生畏。

"你灵活、创意十足、独立且自我驱动(因为在练习期间,你只能与少数其他 METR 员工交流)。工作具有新颖性,你需要很大程度上独自在现场解决很多问题。你擅长失控威胁建模和安全案例拆解,"职位描述中写道。

"你灵活、创意十足、独立且自我驱动。工作具有新颖性,你需要很大程度上独自在现场解决很多问题。你擅长失控威胁建模和安全案例拆解。"

AI 模型训练公司 Mercor 也有类似但描述不那么生动的职位(薪酬在 18 万至 30 万美元之间),候选需要拥有博士或硕士学位,以及在计算机科学、电气工程、计量经济学或其他为机器学习和模型评估打下坚实基础的 STEM 领域拥有两年以上工作经验。

"类似员工的访问权限波动极大"

AI 安全顾问兼 Komodo CTO Kadan Stadelmann 告诉 The New Stack,他每周与每个客户合作的方式都不同。这是因为"类似员工的访问权限波动极大",从严格聚焦的工作领域到广泛的访问权限,这种差异很大程度上由工作开始前签署的合同决定。

"我受邀进入实验室探测众多风险向量,包括现实条件下的 Agent 行为,"Stadelmann 说。"我的职责包括监控思维链和 prompts。目标是建立客观视角,观察特定 AI 系统并质疑它的自主性有多强,完成特定任务需要多长时间。最重要的是,我这个级别的评估人员监控团队对其声称的安全实践的遵守程度。"

软件工程技能比博士学位更吃香

虽然 METR 希望评估人员拥有博士学位,但 Stadelmann 表示,随着这一角色日益普及,他认为科技行业一直以来并将继续由能够展示强大工程技能的人驱动,而非博士。

"我受邀进入实验室探测众多风险向量,包括现实条件下的 Agent 行为。我的职责包括监控思维链和 prompts。"

当被问及成本是否为小型实验室设置了障碍时,Stadelmann 指出,一些 AI 评估工作由第三方非营利组织资助,这保护了独立性。

"但总体而言,评估人员将无法跟上大型前沿模型公司的步伐。他们将失控,我们将依赖他们自己的内部道德准则。而且,无论如何,任何有价值的小型实验室都可能不可避免地被这个领域的大玩家收购,"他补充道。

评估人员发现问题时会发生什么?

面部图像 AI 身份治理公司 Indie Me 创始人兼 CEO Dion Johnson 告诉 The New Stack,他对嵌入式 AI 评估人员最感兴趣的并非职位头衔本身,而是当他们的判断揭示模型以出乎所有人预料的方式行事时会发生什么。

"如果评估人员只能在方便的时候提出担忧,那我们并没有建立起独立监督——我们只是创造了一层流程,"Johnson 说。"评估人员需要有足够的访问权限来看到不舒服的事情,而不仅仅是精心准备的演示。他们需要了解训练过程中发生了什么、测试中什么失败了、什么行为意外出现,以及团队本身在哪些地方仍有不确定性。"

在 AI 评估人员所需的技能方面,Johnson 同意技术深度、机器学习环境安全经验和整体软件工程都很重要。

"要选择一个合格的 AI 评估人员,我会寻找那些对不确定性非常坦然、对假装自己知道不知道的事情非常不安的人。这是一个可以在 AI 模型公司发布日坐在一屋子聪明人中间说'我不信服'的人……而这需要判断力和勇气,"他补充道。

"我会寻找那些对不确定性非常坦然、对假装自己知道不知道的事情非常不安的人。"

AI 领域的恐惧与怨恨

Coxon 在 9 月 8 日的发帖中写道(已被浏览 1.72 亿次,似乎促使 AI 领袖们改变路线),这位 OpenAI 前研究员、后加入 Anthropic 的人写道:"这不是营销噱头。如果有什么的话,许多高管和资深研究人员在媒体上会措辞谨慎以显得合理,但我听到同样的人在私下里表达恐惧。没有任何其他人类活动面临这种级别的危险。"

至于 Coxon 下一步寻找什么样的工作,也许可能是 AI 评估执行工程师的角色。

Original source

本文由 AI 翻译整理自 The New Stack,原文版权归原作者所有。

阅读英文原文
上一篇
LlamaIndex多租户AI Agent记忆层架构实践
下一篇
Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词