Tokeness:统一多个 LLM API 的网关工具实测
一个 API key 统一调用 GPT/Claude/Gemini/DeepSeek/Kimi 等,支持 CNY 结算。对需要多模型集成的开发者有显著提效价值。
一个 API key 统一调用 GPT/Claude/Gemini/DeepSeek/Kimi 等,支持 CNY 结算。对需要多模型集成的开发者有显著提效价值。
TL;DR:我将多模型 API 使用迁移到了 Tokeness(tokeness.io),这是一个第三方 API 网关。一个密钥涵盖 GPT、Claude、Gemini、Grok、DeepSeek、GLM 和 Kimi;支持人民币预付费计费(按 7:1 汇率)和商务发票;控制台中明确列出每 100 万 token 的价格;确实提供可用的免费层级。主要注意事项:GPT/Claude 对中国大陆 IP 被屏蔽(这是他们自己的合规决策,不是 bug),由于是中继所以你的 prompt 会通过他们的服务器,而且价格不固定。下文有详细分析。
我每天都在使用 Claude Code 和 Codex CLI,之前需要分别维护 OpenAI、Anthropic 和 DeepSeek 的账户——三个计费系统、三个密钥管理面板,而且没有国际信用卡会有支付摩擦。几周前我统一迁移到了 Tokeness。我与他们没有关联;只是分享我的发现,因为多模型网关在这里经常被讨论。
一个中继/网关:你把工具指向 https://n.tokeness.io/v1,他们转发到官方 API。既支持 OpenAI 兼容协议,也支持原生 Anthropic 协议,所以 Claude Code、Codex CLI、Cursor、Cline、Dify、n8n 等工具只需要改一行 base_url(他们在 docs.tokeness.io 上有大约 20 个集成指南)。
from openai import OpenAI
client = OpenAI(
api_key="YOUR_TOKENESS_KEY",
base_url="https://n.tokeness.io/v1",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash", # 从他们的模型商城直接复制
messages=[{"role": "user", "content": "hello"}],
)
一个密钥应对所有模型。新模型上线很快——kimi-k3、grok-4.5、gpt-5.6 系列、gemini-3.6-flash 都在 7 月末上线。定价透明度比大多数转销商更好:每个模型在控制台中都明确显示每 100 万 token 的输入/输出价格。没有"官方价格的 30%,自己去算"这种套路。deepseek-v4-flash 已更新到官方 0731 版本,价格比官方便宜 40%。在我的 agent 工作负载测试中表现稳定。真正可用的免费层级:tokeness/free 路由到约 2000 亿参数的模型(DeepSeek V4 Flash 级别)。足以在不付费的情况下测试你的整个集成。商务发票 + 按请求计费的使用日志(状态、模型、每次调用成本)。如果你需要报销 API 成本,这很重要。他们运营一个影响力计划——为开源项目/非营利组织提供每月 1000 万到 50 亿 tokens 的免费额度,规则公开(文档中有链接)。
GPT、Claude 和其他一些模型在中国大陆 IP 下无法使用。他们在 6 月 15 日宣布了这一点作为合规举措。海外网络可以用;中文模型在任何地方都能用。奇怪的是,公开这一限制让我比那些承诺"从中国直接访问 Claude"的转销商更信任他们,但这取决于你所在的位置。这仍然是一个第三方中继。他们声称只转发、不保留——你无法审计这一点。我的规则是:个人项目可以,客户数据/生产密钥只能通过官方 API。这是我对任何转销商都会应用的相同规则。价格不固定。他们提前声明价格会跟随上游成本、外汇和渠道政策。gpt-5.6-luna 最近下跌了 80%,但价格调整可能会反向。他们声称"原始模型,无稀释"。我做了基本的完整性检查(身份问题、已知答案推理 prompt、响应字段结构),没发现异常,但因人而异。
想要一个账单和合适发票的多模型用户,并且网络环境支持 GPT/Claude。不适合核心需求是"从中国大陆直接访问 Claude"的人——他们明确表示这不是他们的服务。
他们还有推荐计划(朋友首次充值额的 20%)——为了完整性提一下,故意不发我的链接。
有其他人在用吗?很好奇他们在更重的 agent 工作负载下的稳定性表现如何。