前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9473
  • OpenAI 发布数百个数学难题的解答成果
  • 29款LLM谄媚度基准测试:前沿模型稳住了,小模型全面溃败
  • Anthropic开放Claude最强版本用于安全测试:已发现10万漏洞
  • 谷歌 EmbeddingGemma 2:7.4 亿参数多模态嵌入模型,手机端 191MB 即可运行
  • 无 API 桌面应用远程控制方案:用 CDP 桥接手机与 Claude Code
  • AI功能按调用计费:多数设计在浪费预算
  • Simon Willison 点评 EmbeddingGemma 2:开源权重是嵌入模型唯一理智选择
  • Mistral Large 4预览发布:参数破万亿
  • Google发布EmbeddingGemma 2:开源多模态嵌入模型
  • Google 开源 EmbeddingGemma 2:740M 参数端侧向量模型,191MB 内存跑离线 RAG
  • 间接提示注入攻击链解析与防御架构
  • Whisper 口述转文字 WER 从 8.5% 降至 2.5% 的实战总结
  • 用 AgentCore + OpenClaw 构建持久记忆的个人 AI 助手
  • Google开源EmbeddingGemma 2:7.4亿参数多模态向量模型
  • Mistral Large 4:1.05万亿参数多模态MoE模型预览
  • Vercel AI Gateway 新增置信度触发降级策略
  • QA 工程师自建工具链:验证 AI 编程 Agent 的实际工作成果
  • 一个 MCP 服务器给 Claude Code 接入 200+ 图像视频生成模型
  • Agentic AI 需要元过滤器而非传统 Guardrails:安全架构新思路
  • 2026 开发者调查:AI 编程助手日活高但信任度低
  • GitLab AI Gateway 高危漏洞让我重新审视自建 Agent 权限控制
  • Mistral Large 4 发布:剑指闭源与开源竞品
  • Mistral Large 4:万亿参数主打安全合规
  • Stack Overflow 2026 开发者调查报告发布
  • Mistral Large 4 公开预览:1万亿参数、月底开源
  • Google Gemini 免费版大幅缩限:Flash Lite 限免,Pro/Deep Think 需付费
  • 上线 LLM 功能不死机的工程检查清单
  • AI代理能识别工具失效但仍持续调用,核心问题在于判断与行为的断裂
  • 给Claude Code开发Mod插件:实现额度用量条与项目待办面板
  • LLM 访问控制与监控的实战避坑指南
  • 企业 RAG 实战:混合搜索与重排序的核心差异
  • 日本开发者给 Claude Code 的 Awwwards 级前端 prompt
  • Reflection发布Beam:非中国最强开源模型,编程推理对标GLM
  • Codex CLI vs Claude Code:相同任务实测成本公开
  • Google Docs原生支持Markdown,AI Agent协作成亮点
  • 已加载 35 / 9473
8.0
热点
AI SCORE
编程提效2026-10-07 05:46

无 API 桌面应用远程控制方案:用 CDP 桥接手机与 Claude Code

dev.to · AI#Claude#CDP#跨设备
Editor brief · 编辑速览

Relaymote 通过读取 Claude Desktop JSON 文件 + Chrome DevTools Protocol 接管权限弹窗,实现手机远程控制 Claude Code 会话。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

我在 Claude Desktop 的 Code 标签页里同时开着很多 Claude Code 会话。走开一段时间回来时,通常会有一个会话正停在权限提示那里。我希望能从手机上查看和回复这些会话。必须要是同一个会话,而不是副本。关键在于,这个桌面应用没有任何公开 API。

这篇文章讲的是我在 Relaymote(MIT 协议、Node.js、Windows 优先)里最终采用的设计方案,其中的经验教训适用于任何"为不支持远程控制而生的桌面应用的遥控器"。

原则 1:从文件读取,通过应用执行

这个划分让其他所有事情都变得可行:

读取从不触碰应用本身。 Claude Desktop 会为每个 Code 会话写入一个小的 JSON 文件(包含标题、文件夹、模型、归档状态),Claude Code 则把每个对话写成一份 .jsonl 转录文件。Relaymote 直接读取这些文件,并且从末尾读取转录内容,因此长会话也能快速打开。所以即桌面应用已经关闭,手机依然能列出和读取会话。

执行操作则通过应用本身。 某些操作只存在于应用内部:发送消息、响应权限提示、重命名、归档。对于这些操作,Relaymote 会挂载到应用主进程的调试器上(Chrome DevTools Protocol,地址是 127.0.0.1)。如果应用有执行该操作的内部方法,就调用该方法;只有在没有这类方法时,才回退到驱动 UI 的方式。

读取操作是流量的大头,因此桌面更新改变 UI 时,只会影响操作,绝不会影响查看功能。

原则 2:永远不要在人类正在操作的界面上输入

当有人正坐在键盘前时,驱动 UI 是危险的。每一个 UI 操作都经过一个序列化的通道,并等待一个空闲门控:即短时间内没有键盘或鼠标输入。因此这个遥控器从构造上就是礼貌的——它不会跟你抢焦点。

原则 3:只有一个入口,而且上了锁

手机端是一个 Web 应用,这就带来了一个安全问题:任何能向编码 Agent 发送消息的东西,间接地都可能在 PC 上执行命令。于是:

控制端口仅绑定到回环地址(loopback only)。

应用端口的每次请求都需要访问密钥。配对过程是一个 QR 链接,密钥只交换一次,存为 HttpOnly cookie。

在 Cloudflare tunnel 后面,密钥仍然是必需的。如果配置了 Cloudflare Access,其 JWT 会被验证(签名、受众、签发者、过期时间),绝不会单独从请求头信任。

推送通知是端到端加密的(RFC 8291),密钥在机器上生成。

原则 4:把等待变成别人的问题

两个小功能在实际日常使用中证明最为重要:

自动恢复。 当会话因用量限制停止时,Relaymote 记录重置时间,并在时间到达后发送一个简短的"continue"。应用退出时处于中途的会话会在下次启动时被检测到并继续。

从被动读取获取状态。 状态圆点和未读状态来自每 30 秒读取一次侧边栏。没有什么是为了看一眼状态而专门打开的。

给做类似项目的人的建议

尽早把读取和执行分开。文件是稳定的接口;UI 不是。

对任何涉及 UI 的操作都要序列化,并且用人类空闲状态作为门控。

把"能发消息"当作"能运行代码",同等力度地锁好门。

把脆弱性写下来。我的在 README 里:桌面更新可能破坏操作功能,直到修复版本发布,而读取功能保持正常。

代码在 GitHub 上,如果你想看调试器桥接层(lib/bridge.js)或空闲门控的 UI 通道(lib/desktop.js)。如果你做过 Electron 应用的 CDP 自动化,我很期待收到反馈。

非官方;与 Anthropic 没有附属关系或背书。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
谷歌 EmbeddingGemma 2:7.4 亿参数多模态嵌入模型,手机端 191MB 即可运行
下一篇
AI功能按调用计费:多数设计在浪费预算