挑中转站前,先躲开 5 个坑
用同样的模型、干同样的活,价格可能相差 7 倍!
01
缓存不生效最花钱
用 Claude Code、Codex 这类 agent 工具连续干活,你每问一句,它都要把前面聊过的全部内容重新发一遍。这部分是重复的,正常情况下按「缓存」计价,只收约 1 折。有的站这套压根没启用——每一轮都按原价重算。
1 折
缓存正常时
重复内容的价钱
重复内容的价钱
3 倍
不生效时
同一段活的账单
同一段活的账单
apirank 怎么帮你 → 我们买各站的 key 连着跑多轮,逐轮看缓存到底有没有读回来 → 中转站费用实测 →
02
缓存命中率低比不生效还贵
更常见的不是「一点缓存都没有」,而是缓存写了、下一轮却读不回来。而写缓存本身是要加钱的(约 1.25 倍原价)——写了读不回,等于每一轮都花高价建一个用不上的缓存,然后再按原价把内容重发一遍。两头都在花钱,比压根不缓存还贵。
7 倍
我们实测到最贵的
一例,同一段活
一例,同一段活
14%
那一例真正
读回来的比例
读回来的比例
近一半
那笔账单里,花在
白建缓存上的钱
白建缓存上的钱
这个坑你自己发现不了。命中率是时高时低的,站方页面不写、控制台也不显示。你看到余额掉得快,只会觉得「这个月写得多」——不会想到是同样的活,别人花的是你的七分之一。
apirank 怎么帮你 → 我们把每一轮读回了多少、重写了多少都摊开,账单差在哪一笔一眼能看到 → 中转站费用实测 →
03
模型掉包 / 降级
表面卖 Claude,后端偷偷换便宜模型顶包。便宜又说不清楚通道来源(订阅切片/区域折扣/IDE 配额等),掉包概率越高。
CISPA 2026 报告
独立研究实测 · arXiv:2603.01919 ↗
45.83%
中转端点未通过身份核验
83→37
同题准确率掉幅 (%)
$5.70
付 $14.84 实得 token 价值
报告里几个典型案例 →
用户点 GPT-5 实际给 glm-4-9b-chat、GPT-4o-mini 给 Qwen2.5-7B、DeepSeek-Reasoner 思考版给非思考版。
apirank 怎么帮你 → 榜单「Claude 真假检测」列就是探针实测,优先选「通过检测」;买之前也可以自己跑一次 一键自测
04
扣费对不上标价
站方页面标一个价,实际从余额里扣的是另一个数。大部分人只看余额少了多少,不会回去核对该扣多少——这笔差价就一直在流。
我们按站方自己公示的价格,把每一次调用该扣多少算出来,再跟它面板里的扣费记录逐条对。实测到过实际扣的是按它自己标价该扣的 5 倍。
apirank 怎么帮你 → 实测页每一行都写明这家扣得对不对、差多少 → 中转站费用实测 →
05
跑路风险
站长拿着用户充值余额突然消失,常在 24 小时内突发。
怎么避 → 没人能预测谁会跑路,唯一可控的是 别在单一站点充太多钱,宁可多充几次小额。
B U Y C H E C K L I S T
下单前,过一遍这 4 项
01
缓存实测生效、命中率高
02
Claude 真假「通过检测」
03
扣费对得上标价
04
支持你要的模型