月花 $200 调 Claude 的我,改了一行 baseURL,账单直接砍掉 70%
月花 $200 调 Claude 的我,改了一行 baseURL,账单直接砍掉 70%
结论先说:不是什么黑魔法,就是把请求打到聚合中转,同样的模型,价格直接打三折。
痛点
我有个每天跑的代码审查 bot,接 Claude Sonnet,每次 context 喂得比较重,平均一次对话 8k tokens in / 2k out。
上个月账单:$187。
不是我写的烂,是 Claude 的 token 价格对于高频调用确实不便宜。我一度考虑换 GPT-4o-mini 凑合,但 Claude 的代码理解质量差距在那儿,不想降级。
然后我发现了一件事:同一个模型,渠道不同,价格能差 3 倍以上。
操作很简单
核心就两步:
第一步:把 baseURL 指向中转
from openai import OpenAI
client = OpenAI(
api_key="你的中转 key",
base_url="https://api.api2everything.xyz/v1"
)
response = client.chat.completions.create(
model="claude-sonnet-4-5", # 直接用原始模型名
messages=[{"role": "user", "content": "review this code: ..."}],
max_tokens=2048
)
print(response.choices[0].message.content)
就这样,其他代码一行不动。OpenAI SDK 兼容格式,Anthropic 的模型也能用 openai 库直接调。
第二步:高频低价值请求走更便宜的 alias
不是所有任务都需要 Sonnet。我现在的策略:
- 代码审查主逻辑 →
claude-sonnet-4-5(该花的花) - 提取函数名、生成注释、格式化输出 →
claude-haiku-4-5 - 批量跑测试用例评估 →
gemini-2.0-flash(便宜且速度快)
改完之后跑了一个月,账单 $54。
顺手用 curl 验证一下连通性
curl https://api.api2everything.xyz/v1/models \
-H "Authorization: Bearer YOUR_KEY" \
| python3 -m json.tool | head -30
能看到模型列表就说明通了,国内直连,不需要代理。
几个我踩过的坑
1. 不要无脑全部换最便宜的模型。我试过全走 Haiku,代码审查质量掉得很明显,改了两天才调回来。混用才是正确姿势。
2. context 长度控制很重要。与其堆 prompt,不如把无关的系统 prompt 裁掉。8k 的 context 压到 4k,价格直接减半,这比换渠道省得还多。
3. 余额过期问题。之前用某些中转,余额三个月不用就清零了,很烦。现在用的这个余额永久有效,囤点不亏。
目前我用的是 无量Api(api2everything.xyz),注册送 ¥1,够跑不少测试请求了,价格比官方便宜 65% 左右,300+ 模型,OpenAI 格式兼容。
有问题欢迎讨论。