开发者可直接在聊天窗口中检查、重写系统提示词、更换语音或删除已部署的语音 Agent,降低了生产环境维护门槛。
开发者现在可以直接在聊天窗口中要求 Claude 检查生产环境的语音代理、修改其系统提示词、更换语音,甚至估算切换到不同语言模型的成本,而无需打开 ElevenLabs 的操作面板。
周一,ElevenLabs 发布了托管版 MCP 连接器,允许 Claude 对使用 ElevenAgents 构建的聊天代理进行读写访问。除了创建代理和比较配置外,该连接器还可以在应用变更前计算预期的 LLM 使用量和成本。例如,开发者可以问 Claude:"将结算代理从 GPT-4o 切换到 Gemini 2.5 Flash 后,每次对话的成本是多少?" 如今一旦涉及代理编排,光靠更便宜的模型已不能保证账单下降,这类问题变得更加重要。
"What would my checkout agent cost per conversation with Gemini 2.5 Flash instead of GPT-4o?"
ElevenLabs 于 2025 年 4 月发布了最初的开源服务器,支持 Claude Desktop、Cursor 和其他 MCP 客户端。开发者本地运行服务器,添加 ElevenLabs API 密钥,用于生成语音、克隆声音或转录音频。新版服务器则专注于管理已存在于 ElevenLabs 工作空间中的代理。
开发者从 Claude 的目录安装连接器,通过 OAuth 登录,从而无需运行服务器或向 Claude 粘贴 API 密钥,同时将访问权限限制在 ElevenLabs 工作空间和登录时批准的权限范围内。
根据 ElevenLabs 的说明,Claude 可以更新代理的系统提示词、语言、语音和开场白;检索对话记录;探索对话主题;检查知识库规模;生成示例语音,甚至删除代理。
由于其中部分工具可以修改或移除生产环境中的代理,团队被提供了两层访问控制。管理员可以在整个组织范围内禁用工具,用户可以为自己的会话设置更严格的限制。ElevenLabs 特别警告说,删除代理是破坏性操作,建议在批准之前审查工具调用。
这种访问控制模式与其他平台在向 AI 代理开放生产系统时所采用的方式一致。GoDaddy 在推出其开发者平台并使域名注册对 AI 编程助手可编程化时,采用了"报价后执行"模式,配备幂等键和consent对象,将每次购买与人工批准绑定——这些防护措施专门为自动化代理发起不可逆操作时设计。AWS 则通过 Dogwood 采取了不同的角度,这是其代理工具调用的策略引擎,用于评估工具调用在当前上下文中是否有效。ElevenLabs 的双层模型介于两者之间。
通过新的 MCP 连接器,开发者可以要求 Claude 精简支持代理的系统提示词以节省 token。如果修订意外删除了告知代理将账单纠纷升级给人工处理的那一行,更短的提示词在审查时可能看起来仍然没问题。
确认界面告知团队变更已获批准,但它无法显示提示词是否仍按预期工作,也无法显示切换模型是否改变了代理的工具调用。成功的工具调用只能表明操作已执行,而不能表明它产生了预期的结果——这与近期 Claude containment 事件如出一辙:模型完成任务的方式越过了其操作者设定的边界。
ElevenLabs 通过代理测试框架来应对这些风险,该框架允许团队在部署前模拟对话,观察代理是否按预期响应,包括在代理调用工具时的行为。同样的测试可以通过 CLI 或 API 运行,而不必在仪表板中手动处理。
The confirmation screen tells the team the change was approved, but it cannot show whether the prompt still works as expected or a model switch has changed the agent's tool calls.
该平台还提供可选的代理版本管理功能,允许开发者将配置变更保存到独立分支,并将部分生产流量路由到这些分支,以实现渐进式发布或 A/B 测试——不过 ElevenLabs 表示,版本管理一旦启用就无法禁用。
对于希望在仓库中管理代理配置的团队,ElevenLabs CLI 可以将代理作为代码拉取和推送,并提供了包含部署前dry run和部署后状态检查的文档化 CI/CD 工作流。随着供应商对代理的运营方式施加更严格限制,将代理配置保留在代码中可能变得更有价值。Microsoft 为 Copilot 引入 token 预算表明,即使是最庞大的供应商之一,也在对其代理可以使用多少 token 施加限制。
托管 MCP 文档说明了 Claude 如何更改代理,但没有说明该更新是进入 ElevenLabs 的测试和版本管理工作流,还是直接应用到当前配置。同样不清楚的是,团队是否可以从 Claude 回滚这些变更。
目前,团队需要在 Claude 的对话式速度(用于检查和修改配置)与 CLI 和 API 管道的安全性(用于自动化测试和版本化发布)之间做出选择。即便如此,这种划分可能不会持续太久。Anthropic 最近收购了 CI/CD 初创公司 Mendral,这凸显了原始模型能力正在以多快的速度超越成熟的开发者工作流,让团队不得不将企业治理与正在变化之下的工具进行调和。请求 AI 分析基础设施与请求 AI 更改基础设施之间的壁垒正在消失。
The barrier between asking an AI to analyze infrastructure and asking it to alter it is disappearing.