Skip to content

FAQ 常见问题

账号与计费

需要 VPN 吗?

不需要。 快米兔 API 国内直连,家宽、公司网、国内云服务器都能直接访问 api.52pay.com

反过来说:开着 VPN 反而可能更慢,因为流量绕了一圈国外。遇到速度问题先把代理关掉试试。

怎么充值?支持发票吗?

控制台「充值」页在线支付,或找客服要兑换码。

支持对公转账并开具增值税普票 / 专票,资料齐全即可申领,联系在线客服办理。

余额怎么算?站内显示的「倍率」是什么意思?

站内以人民币显示余额,底层按美元额度结算。倍率换算规则:

输入价格($/1M tokens)= 模型倍率 × 2 × 分组倍率

详细说明和例子见 模型与分组 → 倍率怎么换算成钱

额度会过期吗?

充值的额度不设过期。但令牌可以单独设过期时间,到期后那把令牌失效(额度还在账号里)。

一个账号能建几把令牌?

不限。建议按用途分开建(每台机器一把、每个项目一把),出问题时在日志里一眼能看出是谁在用。


接入配置

Base URL 到底填什么?

看你的客户端走哪套协议:

协议地址
Anthropic(Claude Code 等)https://api.52pay.com
OpenAI 兼容(Cursor / Cline / ChatBox 等)https://api.52pay.com/v1
Gemini(Gemini CLI 等)https://api.52pay.com

规律:客户端自己会拼完整路径(/v1/messages)的,你只填域名;客户端拼相对路径(/chat/completions)的,你要带 /v1

填错的表现就是 404 或者返回一坨 HTML。

一把令牌能同时用于 Claude 和 GPT 吗?

能。 同一把令牌三套协议通用,只要令牌所属分组开放了对应模型。

分组该选哪个?

先用 default——它覆盖全部模型,倍率还最低(0.7)。

只有在 default 上频繁遇到 503 / 限速时,才换专用分组(Claude Code MaxOpenaiGemini 等)。详见 模型与分组

能在请求里临时切换分组吗?

不能。分组在建令牌时绑定。要用另一个分组,再建一把令牌——令牌不限量也不额外收费。

支持 Prompt Cache 吗?

支持,原样透传cache_control 标记和返回的 cache_creation_input_tokens / cache_read_input_tokens 都与直连官方一致。

Claude 系模型的缓存倍率是 0.1,命中部分按十分之一计费。见 成本优化策略

支持 1M 上下文吗?

支持。anthropic-beta: context-1m-2025-08-07 头会被透传。

如果返回 400/503,说明当次路由到的上游账号没有 1M 权限——重试,或改用不带 [1m] 后缀的模型名。

支持函数调用 / 工具调用 / 视觉输入吗?

支持,取决于模型本身的能力。在 价格页 上每个模型都标了能力标签(Tools / Vision / Files / Audio / Reasoning)。

支持流式吗?

支持。SSE 全链路不缓冲,stream: true 直接用。

建议同时加 stream_options: {"include_usage": true},这样最后一个 chunk 会带上 token 消耗,方便你自己做统计。


客户端

Claude Code 一直要我 /login 怎么办?

先进交互模式执行 /logout 清掉官方登录态,然后确认用的是 ANTHROPIC_AUTH_TOKEN 而不是 ANTHROPIC_API_KEY(某些版本下后者会触发官方登录检查)。

详见 Claude Code 接入

Cursor 配了自定义 Key,为什么 Tab 补全还是官方的?

这是 Cursor 自身的限制:Tab 补全、Composer、代码库索引走 Cursor 自有后端,不受自定义 API Key 影响。自定义 Key 只作用于 Chat 和 Cmd-K。

要完整体验 + 便宜模型,推荐用 Cline 装在 VS Code 里,功能不会被阉割。

Claude Desktop 能用吗?

不能。 官方桌面应用不支持自定义 API 端点,只认账号登录。

替代方案见 Claude Desktop

Codex CLI 报 Unsupported endpoint 怎么办?

那个模型不支持 Responses 协议。把 wire_api"responses" 改成 "chat"

怎么确认流量真的走了快米兔?

控制台日志 看有没有对应时间的记录。有记录 = 走了;没记录 = 客户端还在用它自己的后端。

这是排查「配置到底生效没有」的唯一可靠方法。


排错

401 无效的令牌

按概率排查:复制时带了空格 → 令牌被删了 → 环境变量没生效 → 变量名用错了。

详见 401 排查

无可用渠道

模型名写错,或者你令牌的分组里没开这个模型。

bash
curl https://api.52pay.com/v1/models -H "Authorization: Bearer <您的令牌>"

这个列表就是你能用的全部模型。详见 503 排查

一直 retry,永远不成功

底下有一个必然失败的错误被无限重试了。用 claude --debug 看真正的错误,或去日志页看失败记录。

不要调高重试次数——每次重试都单独计费。详见 retry 死循环

流式一直转圈不出字

三种可能:本地代理缓冲了 SSE、模型在思考(推理模型正常现象)、请求太大。

排查步骤见 流式无输出

速度慢

  1. 先关 VPN——国内直连不需要代理,开了反而绕远
  2. 换个便宜快的模型试(claude-haiku-4-5-20251001gemini-3.1-flash-lite
  3. 降低推理强度
  4. 检查上下文是不是太长了(/clear

成本

为什么我的输入 token 那么多?

编码 Agent 每一轮都会重发「系统提示 + CLAUDE.md + MCP 工具定义 + 全部历史对话 + 读过的文件」。跑 30 轮的会话,输入通常是输出的 20–50 倍。

最有效的解法:换任务就 /clear

完整策略见 成本优化策略

怎么知道钱花哪了?

控制台日志,按令牌名筛选,看模型列和 token 列。

三种典型烧钱模式:会话开太久没清、缓存一直没命中、所有活都用 Opus 干。

有没有一句话版的省钱建议?

换任务就 /clear,日常用 Sonnet 不用 Opus,令牌选 default 分组。

这三条大概能覆盖 80% 的浪费。


其它

数据会被记录吗?

服务端会记录调用日志(时间、模型、token 数、消耗额度)用于计费和排错。请求和响应正文不作留存用途。

涉及敏感数据的场景,请自行做脱敏后再发送。

支持并发吗?限速是多少?

支持并发。站点有频率限制以保障公平使用,触发时返回 429。

有稳定的高并发需求,联系客服说明场景。

模型会新增/下线吗?

会。上游厂商发新模型后本站会跟进上架,废弃的模型会下线。

价格页 为准——那个页面直接读数据库,永远是最新的。本文档里的模型表是快照,可能滞后。

找不到答案怎么办?

联系站内在线客服,带上:

  1. X-Oneapi-Request-Id
  2. 完整错误信息
  3. 客户端 + 版本 + Base URL
  4. 模型 ID + 令牌分组

文档持续更新 · 以 站内价格页 与控制台实际配置为准