省钱实战 · 阅读约 2 分钟

月花 $200 调 Claude 的我,改了一行 baseURL,账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行 baseURL,账单直接砍掉 70%

结论先说:不是什么黑魔法,就是把请求打到聚合中转,同样的模型,价格直接打三折。


痛点

我有个每天跑的代码审查 bot,接 Claude Sonnet,每次 context 喂得比较重,平均一次对话 8k tokens in / 2k out。

上个月账单:$187。

不是我写的烂,是 Claude 的 token 价格对于高频调用确实不便宜。我一度考虑换 GPT-4o-mini 凑合,但 Claude 的代码理解质量差距在那儿,不想降级。

然后我发现了一件事:同一个模型,渠道不同,价格能差 3 倍以上。


操作很简单

核心就两步:

第一步:把 baseURL 指向中转


from openai import OpenAI



client = OpenAI(

    api_key="你的中转 key",

    base_url="https://api.api2everything.xyz/v1"

)



response = client.chat.completions.create(

    model="claude-sonnet-4-5",  # 直接用原始模型名

    messages=[{"role": "user", "content": "review this code: ..."}],

    max_tokens=2048

)

print(response.choices[0].message.content)

就这样,其他代码一行不动。OpenAI SDK 兼容格式,Anthropic 的模型也能用 openai 库直接调。

第二步:高频低价值请求走更便宜的 alias

不是所有任务都需要 Sonnet。我现在的策略:

  • 代码审查主逻辑 → claude-sonnet-4-5(该花的花)
  • 提取函数名、生成注释、格式化输出 → claude-haiku-4-5
  • 批量跑测试用例评估 → gemini-2.0-flash(便宜且速度快)

改完之后跑了一个月,账单 $54。


顺手用 curl 验证一下连通性


curl https://api.api2everything.xyz/v1/models \

  -H "Authorization: Bearer YOUR_KEY" \

  | python3 -m json.tool | head -30

能看到模型列表就说明通了,国内直连,不需要代理。


几个我踩过的坑

1. 不要无脑全部换最便宜的模型。我试过全走 Haiku,代码审查质量掉得很明显,改了两天才调回来。混用才是正确姿势。

2. context 长度控制很重要。与其堆 prompt,不如把无关的系统 prompt 裁掉。8k 的 context 压到 4k,价格直接减半,这比换渠道省得还多。

3. 余额过期问题。之前用某些中转,余额三个月不用就清零了,很烦。现在用的这个余额永久有效,囤点不亏。


目前我用的是 无量Api(api2everything.xyz),注册送 ¥1,够跑不少测试请求了,价格比官方便宜 65% 左右,300+ 模型,OpenAI 格式兼容。

有问题欢迎讨论。