作者通过 LiteLLM 代理,让 Claude Code CLI 改用 AWS Bedrock 上的 Amazon Nova,同时保留 Agent 循环与工具调用流程。该方案旨在利用 AWS 额度降低学习长上下文和 Agent 编程时的 API 成本。
最近我一直在学习如何使用 Claude Code 进行 Agentic 开发,但在还没真正弄明白这个工具如何运作之前,我不想把付费 API 额度白白消耗掉。直接调用 Anthropic API 时,每一个错误的 prompt、每一次半途而废的会话,以及每一句“让我快速试一下”,都会产生费用。
于是,我花了一个周末搭建了一个小型 LiteLLM proxy,让 Claude Code CLI 可以改为与 AWS Bedrock 上的 Amazon Nova 通信。它拥有相同的 Agent 循环、相同的工具调用,以及通常使用 Claude Code 时会获得的相同工作流,只不过指向了另一个后端,消耗的是 AWS credits,而不是按 API 调用计费。
我研究了市面上那些用于低成本或免费练习 Agentic 编程的常见方案,但没有一个能真正支撑完整的实际会话:
Ollama 本地运行——需要一台性能强劲的机器,还得有充足的内存和 GPU 余量。大多数人手边并没有这样的设备,而我也不想仅仅为了练习就专门购买一套。
OpenRouter 这类提供免费额度的服务——只需几个基础 prompt,就会触及 token 限制。对于需要模型持续来回调用工具的长时间 Agentic 工作流来说,这点额度远远不够。我想要的是一种能让我学习工具使用、Agent 循环和长上下文处理的方案,而不会在会话进行到一半时撞上这两堵墙中的任何一堵。
最终方案是在 Claude Code CLI 与 AWS Bedrock 之间放置一个 LiteLLM proxy,由它负责转换请求。这样一来,Claude Code 会以为自己正在与 Anthropic API 通信,而请求实际上被路由到了 Amazon Nova。
有几件事是我有意严格限制的:
不设置人为的会话上限。因为这是自托管的,所以不存在供应商强加的限制,不会限制我能运行多长时间或多频繁地启动会话。
所有服务都使用 AWS credits 运行,而不是按 API 调用计费。
按照目前的 Bedrock 费率计算,每个 token 的成本大约比 Claude Haiku 低 20%~35%。
IAM 权限仅限定到单个模型。我严格限制了这个角色的权限,因此即使发生误操作,proxy 也根本无法调用任何更昂贵的模型。
已配置 AWS Budget 告警,因此不会等到账单失控之后才发现问题。如果你想自己研究一下,Docker image 和配置都已公开:https://github.com/PriyanshuValiya/Claude-Code/blob/main/README.md
如果不想购买硬件,也不想每十分钟就撞上一次免费额度限制,那么这确实是我找到的、用于运行长时间 Agentic 会话的实用方案之一。如果你正在尝试真正理解这些编程 Agent 如何制定计划、调用工具,以及从错误中恢复,那么能有足够空间运行长会话,比底层使用“最强”的模型更重要。
但我想明确说明它不是什么:它并不是免费的 Claude。它只是一个翻译层,让 Claude Code 客户端可以与一个完全不同的模型通信。Amazon Nova 不是 Claude,它的输出、推理质量和工具调用行为,都不会与 Anthropic 真正的模型一致。如果你正在评估 Claude Code 本身,或者构建准备正式发布的产品,那么这套方案会让你得到一个存在偏差的印象。
它真正适合的用途,也正是我构建它的原因:学习 Agentic 编程工具的运行机制,包括 Agent 循环、工具调用和上下文管理,而不必在每次会话运行时间变长时都担心信用卡账单。
如果你和当时的我处境相同,想学习 Claude Code,却既不愿购买一套 GPU 设备,也不想只输入三个 prompt 就被切断服务,那么 Bedrock proxy 是一个合理的折中方案。只是在真正需要评判模型本身时,不要把它误认为真正的 Claude;这种比较只有在使用 Anthropic 实际 API 的情况下才有意义。
如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。