主题
FAQ 常见问题
账号与计费
需要 VPN 吗?
不需要。 快米兔 API 国内直连,家宽、公司网、国内云服务器都能直接访问 api.52pay.com。
反过来说:开着 VPN 反而可能更慢,因为流量绕了一圈国外。遇到速度问题先把代理关掉试试。
怎么充值?支持发票吗?
控制台「充值」页在线支付,或找客服要兑换码。
支持对公转账并开具增值税普票 / 专票,资料齐全即可申领,联系在线客服办理。
余额怎么算?站内显示的「倍率」是什么意思?
站内以人民币显示余额,底层按美元额度结算。倍率换算规则:
输入价格($/1M tokens)= 模型倍率 × 2 × 分组倍率详细说明和例子见 模型与分组 → 倍率怎么换算成钱。
额度会过期吗?
充值的额度不设过期。但令牌可以单独设过期时间,到期后那把令牌失效(额度还在账号里)。
一个账号能建几把令牌?
不限。建议按用途分开建(每台机器一把、每个项目一把),出问题时在日志里一眼能看出是谁在用。
接入配置
Base URL 到底填什么?
看你的客户端走哪套协议:
| 协议 | 地址 |
|---|---|
| Anthropic(Claude Code 等) | https://api.52pay.com |
| OpenAI 兼容(Cursor / Cline / ChatBox 等) | https://api.52pay.com/v1 |
| Gemini(Gemini CLI 等) | https://api.52pay.com |
规律:客户端自己会拼完整路径(/v1/messages)的,你只填域名;客户端拼相对路径(/chat/completions)的,你要带 /v1。
填错的表现就是 404 或者返回一坨 HTML。
一把令牌能同时用于 Claude 和 GPT 吗?
能。 同一把令牌三套协议通用,只要令牌所属分组开放了对应模型。
分组该选哪个?
先用 default——它覆盖全部模型,倍率还最低(0.7)。
只有在 default 上频繁遇到 503 / 限速时,才换专用分组(Claude Code Max、Openai、Gemini 等)。详见 模型与分组。
能在请求里临时切换分组吗?
不能。分组在建令牌时绑定。要用另一个分组,再建一把令牌——令牌不限量也不额外收费。
支持 Prompt Cache 吗?
支持,原样透传。cache_control 标记和返回的 cache_creation_input_tokens / cache_read_input_tokens 都与直连官方一致。
Claude 系模型的缓存倍率是 0.1,命中部分按十分之一计费。见 成本优化策略。
支持 1M 上下文吗?
支持。anthropic-beta: context-1m-2025-08-07 头会被透传。
如果返回 400/503,说明当次路由到的上游账号没有 1M 权限——重试,或改用不带 [1m] 后缀的模型名。
支持函数调用 / 工具调用 / 视觉输入吗?
支持,取决于模型本身的能力。在 价格页 上每个模型都标了能力标签(Tools / Vision / Files / Audio / Reasoning)。
支持流式吗?
支持。SSE 全链路不缓冲,stream: true 直接用。
建议同时加 stream_options: {"include_usage": true},这样最后一个 chunk 会带上 token 消耗,方便你自己做统计。
客户端
Claude Code 一直要我 /login 怎么办?
先进交互模式执行 /logout 清掉官方登录态,然后确认用的是 ANTHROPIC_AUTH_TOKEN 而不是 ANTHROPIC_API_KEY(某些版本下后者会触发官方登录检查)。
详见 Claude Code 接入。
Cursor 配了自定义 Key,为什么 Tab 补全还是官方的?
这是 Cursor 自身的限制:Tab 补全、Composer、代码库索引走 Cursor 自有后端,不受自定义 API Key 影响。自定义 Key 只作用于 Chat 和 Cmd-K。
要完整体验 + 便宜模型,推荐用 Cline 装在 VS Code 里,功能不会被阉割。
Claude Desktop 能用吗?
不能。 官方桌面应用不支持自定义 API 端点,只认账号登录。
替代方案见 Claude Desktop。
Codex CLI 报 Unsupported endpoint 怎么办?
那个模型不支持 Responses 协议。把 wire_api 从 "responses" 改成 "chat"。
怎么确认流量真的走了快米兔?
去 控制台日志 看有没有对应时间的记录。有记录 = 走了;没记录 = 客户端还在用它自己的后端。
这是排查「配置到底生效没有」的唯一可靠方法。
排错
报 401 无效的令牌
按概率排查:复制时带了空格 → 令牌被删了 → 环境变量没生效 → 变量名用错了。
详见 401 排查。
报 无可用渠道
模型名写错,或者你令牌的分组里没开这个模型。
bash
curl https://api.52pay.com/v1/models -H "Authorization: Bearer <您的令牌>"这个列表就是你能用的全部模型。详见 503 排查。
一直 retry,永远不成功
底下有一个必然失败的错误被无限重试了。用 claude --debug 看真正的错误,或去日志页看失败记录。
不要调高重试次数——每次重试都单独计费。详见 retry 死循环。
流式一直转圈不出字
三种可能:本地代理缓冲了 SSE、模型在思考(推理模型正常现象)、请求太大。
排查步骤见 流式无输出。
速度慢
- 先关 VPN——国内直连不需要代理,开了反而绕远
- 换个便宜快的模型试(
claude-haiku-4-5-20251001、gemini-3.1-flash-lite) - 降低推理强度
- 检查上下文是不是太长了(
/clear)
成本
为什么我的输入 token 那么多?
编码 Agent 每一轮都会重发「系统提示 + CLAUDE.md + MCP 工具定义 + 全部历史对话 + 读过的文件」。跑 30 轮的会话,输入通常是输出的 20–50 倍。
最有效的解法:换任务就 /clear。
完整策略见 成本优化策略。
怎么知道钱花哪了?
控制台日志,按令牌名筛选,看模型列和 token 列。
三种典型烧钱模式:会话开太久没清、缓存一直没命中、所有活都用 Opus 干。
有没有一句话版的省钱建议?
换任务就 /clear,日常用 Sonnet 不用 Opus,令牌选 default 分组。
这三条大概能覆盖 80% 的浪费。
其它
数据会被记录吗?
服务端会记录调用日志(时间、模型、token 数、消耗额度)用于计费和排错。请求和响应正文不作留存用途。
涉及敏感数据的场景,请自行做脱敏后再发送。
支持并发吗?限速是多少?
支持并发。站点有频率限制以保障公平使用,触发时返回 429。
有稳定的高并发需求,联系客服说明场景。
模型会新增/下线吗?
会。上游厂商发新模型后本站会跟进上架,废弃的模型会下线。
以 价格页 为准——那个页面直接读数据库,永远是最新的。本文档里的模型表是快照,可能滞后。
找不到答案怎么办?
联系站内在线客服,带上:
X-Oneapi-Request-Id- 完整错误信息
- 客户端 + 版本 + Base URL
- 模型 ID + 令牌分组
