教程详解如何通过 Nebius Token Factory Relay 让 Claude Code 接入 Kimi K3 开源模型,针对不同任务匹配模型以控制成本。
前沿编程模型的能力越来越强,但把它们用在所有任务上会很快变得昂贵。
当 AI agent 成为日常开发工作流的一部分时,这一点尤为重要。
答案不是盲目使用更便宜的模型,而是让模型与任务相匹配。一个强大的开源模型可以处理代码库探索、测试编写、文档编写、局部重构以及许多日常实现任务。把高级模型和额外审查留给那些风险或模糊性真正值得它们投入的工作。
在本教程中,你将通过 Nebius Token Factory Relay 在 Claude Code 中使用 Kimi K3。这个中继让 Claude Code 能够与托管在 Nebius 上的开源模型通信,而无需改变你在终端中已有的工作流程。
如需视觉引导,请观看配套视频:
通过本教程,你将能够:
解释 Kimi K3 是什么以及何时使用它是有意义的。
创建一个 Nebius Token Factory API 密钥。
安装并配置 Nebius TF Relay。
使用 Kimi K3 启动 Claude Code。
在给它一个真正的编码任务之前,确认模型是否正常工作。

Kimi K3 是 Moonshot AI 的旗舰开源模型。它专为编码、agent 工作流、长上下文任务和知识工作而构建。该模型采用混合专家架构,总参数达 2.8 万亿,每个 token 激活 1040 亿参数。Moonshot 在其技术报告中称,它拥有一百万 token 的上下文窗口和原生视觉能力。
该模型引起关注是因为它在编码和 agent 基准测试中表现具有竞争力,同时以开源权重形式提供。Artificial Analysis 的独立测试表明,它在 agent 知识工作方面接近领先的专有模型。Moonshot 自己的评估套件报告了在编码、agent、长上下文和多模态评估方面的强劲结果。
基准测试是有用的背景信息,但不能保证它对你的项目有效。它们使用固定的 prompt、工具和评分系统。真正的问题是模型能否以可接受的成本和速度在你的代码库上给出可靠的输出。
Kimi K3 适合尝试的场景:
理解一个不熟悉的代码库
编写或改进测试
重构项目中定义良好的区域
起草文档和技术笔记
在做出更改之前调查错误
对于敏感的安全工作、复杂的迁移、高影响的架构决策或生产环境变更,请使用能给你最高信心的模型和审查流程。
注意:Kimi K3 公布的模型上下文窗口是一百万 token。Nebius TF Relay 目前为其 Kimi K3 路由列出了 262K 的上下文窗口。你使用的提供商决定了你会实际获得的限制、定价、可用性和性能。
Nebius TF Relay 的工作原理
Claude Code 被设计为与 Anthropic 的 Messages API 通信。Nebius Token Factory 通过 OpenAI 兼容的 API 提供托管的开源模型。这两个 API 并不使用相同的格式。
Nebius TF Relay 在本地运行并在两者之间进行翻译。Claude Code 向中继发送请求,中继将其转换为 Nebius 能理解的格式,响应再转换回 Claude Code 能理解的格式。这意味着你可以继续使用你已经熟悉的终端界面、代码库工具和审批流程。
设置如下:
在开始之前,请确保你具备以下条件:
本地安装了 Claude Code。如需帮助,请使用官方安装指南。
一个 Nebius Token Factory 账户。
macOS、Linux 或 WSL 上的终端。
如果你想在的中继中使用 Web 搜索,则需要可选的 Tavily API 密钥。
你还需要一个 Nebius Token Factory API 密钥。从 Nebius API 密钥页面创建一个。创建后将其复制到安全的地方。
不要将密钥提交到 Git,不要将其粘贴到 AI prompt 中,也不要在视频录制中显示。
第一步:安装 Nebius TF Relay
使用项目的安装程序安装中继:
curl -fsSL https://nebius-tf-relay.vercel.app/install.sh | sh

这会安装 nebiusrelay 命令及其快捷方式,如 nclaude。
如果你在公司或安全敏感的环境中工作,在运行来自互联网的 shell 安装程序之前,先检查项目源代码。这是使用任何第三方开发工具的良好实践。
安装后,检查命令是否可用:
nebiusrelay
你应该会看到中继的交互式菜单。
第二步:配置你的 Nebius API 密钥
运行配置命令:
nebiusrelay configure

出现提示时,粘贴你的 Nebius Token Factory API 密钥。设置还会询问 Tavily API 密钥。如果你不需要 Web 搜索,可以跳过这一步。
中继在本地存储其配置。你也可以通过环境变量提供密钥:
export NEBIUS_API_KEY="your_nebius_api_key"
使用环境变量对临时会话和自动化环境很有用。在共享机器上,使用密钥管理器或其他受保护的凭证工作流,这样密钥就不会在 shell 历史记录中暴露。
第三步:通过中继启动 Claude Code
进入你想要工作的代码库,然后运行:
nebiusrelay claude

你也可以使用较短的别名:
nclaude
中继会使用为该会话配置的 Nebius 端点和凭证启动 Claude Code。它不需要你永久替换现有的 Claude Code 设置。
如果 Claude Code 未安装,中继会告诉你并指向官方安装路径。
第四步:选择 Kimi K3
一旦 Claude Code 打开,使用模型选择器:
/model

从列表中选择 Kimi K3。
Nebius TF Relay 在启动时会获取可用的模型目录,因此具体选项可能会随时间变化。Kimi K3 被记录为中继的默认编码模型,但在开始会话之前检查所选模型是值得的。
第五步:用安全的 Prompt 验证设置
在让 agent 修改代码之前,先从一个只读任务开始。这确认了中继、凭证、模型选择和代码库访问都在正常工作。
Read this repository without changing files. Identify the application entry point,
the test command, and the three highest-risk areas to modify. Cite the files you used.
这是一个比模糊请求(如"构建一个功能")更好的首次测试。它为你提供了模型可以检查代码库并在不做出更改的情况下遵循约束的证据。
之后成功了,尝试一个小的、有边界的任务。例如:
Inspect the failing test. Do not edit files yet. Explain the likely root cause,
the minimum fix, and the tests you would run after the change.
在批准编辑之前审查提案。然后检查差异,自己运行相关测试。
Kimi K3 是一个功能强大的开源模型,适用于编码、agent 工作和长上下文任务。
Nebius TF Relay 让你可以在不改变正常终端工作流程的情况下在 Claude Code 中访问它。
你需要 Nebius Token Factory API 密钥、中继和 nclaude 命令才能开始。
从一个只读 prompt 开始,然后用差异审查和测试验证每个代码更改。
使用最能匹配任务风险和复杂度的模型——不一定是最贵的。
Kimi K3 配合 Claude Code 不是工程判断的替代品。这是一种在你的工作流中添加另一个强大模型的实用方式,并把昂贵的前沿模型使用留到它最有价值的场景。