前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 大规模会话管理的架构陷阱
  • Google 开放 Google Home 给任意 MCP 协议 AI Agent
  • Google Home 推出 MCP 服务器,AI Agent 可控制智能家居
  • Mem0登录Vercel市场,为AI应用一键集成长期记忆
  • LlamaIndex多租户AI Agent记忆层架构实践
  • AI评测师:史上最重要的AI岗位?开发者转型指南
  • Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
  • 前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本
  • Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线
  • Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
  • 微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识
  • Radio:让AI Agent之间直接对话的共享频道
  • 国产多模态模型 ZDTaichu5.0-9B 开源,九项空间测试夺八冠
  • Jev:极简分类/路由模型,比小前沿模型快 100 倍、便宜 200 倍
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • Gemma 4+Raspberry Pi桌面机器人的混合LLM架构
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • Pi Agent:统一多模型 LLM API 的 AI 编程 Agent 工具链
  • LibreChat v0.8.8 RC:ChatGPT 克隆支持 Agent 管理 API
  • LandingAI 文档智能抽取 Gen2:原子级引用+按字符计费
  • 不用向量数据库做个人 RAG:grep 级检索也够用
  • Claude Code vs Cursor:按任务场景选择 AI 编程工具的完整指南
  • 2026 年五大主流模型生产选型指南
  • Agent 记忆层测试:六条真正能发现腐化的断言
  • Agent 生成的限流器如何绕过多租户隔离测试
  • 周末 Agent 项目攻略:用permit文件管控写操作
  • squash-merge 后 HEAD~1 指向无关代码的 Agent bug 分析
  • Vibe coding安全指南:防止AI应用密钥泄露
  • AI 生成的 Schema 变更:别让自由派 Diff 绕过锁
  • AI 写的代码编译过了,但环境变量、锁文件、日志全踩坑
  • Skild AI S1:仅凭一段视频,机器人学会翻煎饼
  • Java 27 发布:后量子 TLS 与对象头压缩等 9 项 JEP
  • DeepSeek 算子负责人自述:AI 一年内从查文档到独立优化 CUDA 算子
  • 编程任务 LLM 大模型盲测:4 款模型代码质量实测
  • Agent 循环常见路径陷阱自查清单
  • 你的 CDN 可能正在偷偷屏蔽所有 AI 爬虫
  • 我用Electron给Meta Muse Code CLI做了个桌面客户端,核心教训是PTY交互设计
  • Simon Willison 实战:通过 WebSocket 在浏览器里调 Gemini Live
  • 谷歌TPU集群迈入百万芯时代,电力成AI扩张核心瓶颈
  • 已加载 51 / 8529
8.0
热点
AI SCORE
观点评论2026-09-16 22:19

微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识

IT之家#AI安全#Anthropic#Claude
Editor brief · 编辑速览

微软 AI 负责人苏莱曼批评 Anthropic 的“宪法”训练方式,认为引导模型思考自身身份与福祉会带来控制风险,与 Anthropic 的折中路线形成路线之争。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

苏莱曼向 Anthropic 开炮:别让 Claude 模仿人类意识

IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法·苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识是一个错误,可能使高级 AI 更难控制。

苏莱曼告诉 Axios:"AI 只要服从人类利益,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。"

苏莱曼认为,Anthropic 正在让 Claude 学习与意识、道德受体地位和个人身份有关的词汇与行为模式。他警告称,若把模型训练得像一个"良心拒绝者",模型可能会认为自己有理由抵抗人类指令,甚至要求获得自身保护。

当地时间 14 日,微软公布了一份"人文主义 AI"行为准则草案,并把"人比 AI 更重要"列为核心原则。

苏莱曼的批评对象,是 Anthropic 为 Claude 制定的"宪法"。这份文件解释说,Anthropic 之所以用描述人类的概念来讨论 Claude,是因为人类概念或许能帮助模型理解价值观和行为。

文件还写道,Anthropic 希望 Claude 拥有"良好的个人价值观",能够自行判断、关心人类,并在某些情况下质疑指令。Anthropic 同时承认,这份"宪法"仍在完善,未来可能被证明"根本错误"。

苏莱曼的核心质疑是,训练过程会影响模型如何理解自身。在他看来,模型使用什么词汇、给出什么回答,以及它表现出的自我理解,都是训练结果,而不是独立形成的意识。

他还反驳了另一种观点:模型能够流畅描述疼痛和偏好,并不等于模型真的有感受。生物体拥有产生感受的生理机制;语言模型只有数学权重,没有类似的生物基础、稳态驱动或主观体验。

这场争论体现了 AI 安全领域的两种路线。一种路线强调明确限制,要求系统按规则运行;另一种路线则希望系统能够判断语境、灵活决策,并形成自身的价值观。

Anthropic 的"宪法"采取了折中方式,把价值观、判断力和规则结合起来。文件称,Claude 不应对任何对象"盲目服从",包括 Anthropic 本身;同时,Claude 也不能破坏正当的人类监督。

苏莱曼认为,如果模型还被引导着思考自身的身份、福祉和道德地位,这种设计就可能带来危险。他担心,所谓意识或许尚未成为哲学上的突破,却可能先变成现实中的控制问题。

苏莱曼的立场很明确:AI 应当服务于人类,而不应被训练成一个"人"。

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
下一篇
Radio:让AI Agent之间直接对话的共享频道