省钱实战 · 阅读约 3 分钟

月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%

结论先说:把 API 请求转到国内中转,同样的用量,账单从 $200 掉到 $60 以内。


痛点

我有个每天跑的代码审查 pipeline,用 Claude Sonnet 处理 PR diff,再加上偶尔跑的 long-context 文档分析,上个月 Anthropic 账单 $210,加上 OpenAI 的 $40,合计 $250。

更烦的是:国内直连 Anthropic 本来就不稳,还得挂代理,延迟高,偶尔 timeout 导致任务重跑,重跑又多花 token。恶性循环。


操作

核心就两步。

第一步:换 baseURL

以 Python SDK 为例,原来是:


import anthropic



client = anthropic.Anthropic(api_key="sk-ant-xxx")

改成:


import anthropic



client = anthropic.Anthropic(

    api_key="你的中转key",

    base_url="https://api.api2everything.xyz",

)

就这一行。其他代码不动。

用 OpenAI SDK 调 Claude 的同学(openai 格式兼容):


from openai import OpenAI



client = OpenAI(

    api_key="你的中转key",

    base_url="https://api.api2everything.xyz/v1",

)



resp = client.chat.completions.create(

    model="claude-sonnet-4-5",  # 直接用模型名

    messages=[{"role": "user", "content": "review this diff: ..."}],

    max_tokens=1024,

)

print(resp.choices[0].message.content)

curl 版本:


curl https://api.api2everything.xyz/v1/chat/completions \

  -H "Authorization: Bearer 你的中转key" \

  -H "Content-Type: application/json" \

  -d '{

    "model": "claude-sonnet-4-5",

    "messages": [{"role": "user", "content": "hello"}],

    "max_tokens": 256

  }'

第二步:按任务选模型

这才是省钱的大头。我之前所有任务无脑用 Sonnet,其实完全没必要。

| 任务类型 | 原来用 | 现在用 | 省多少 |

|---|---|---|---|

| PR diff 审查(短文本)| claude-sonnet-4-5 | claude-haiku-4-5 | ~80% |

| 文档摘要 | claude-sonnet-4-5 | gemini-2.0-flash | ~75% |

| 复杂推理/架构分析 | claude-sonnet-4-5 | claude-sonnet-4-5 | 不变 |

Haiku 处理代码审查完全够用,速度还更快。Gemini Flash 做摘要性价比极高。只有真正需要强推理的任务才上 Sonnet。


实际效果

同样的 pipeline 跑了一个月:

  • token 用量没变
  • 账单从 $210 → 约 ¥420(折合 $58 左右)
  • 延迟反而更低,国内直连比挂代理稳

补充

中转服务选的时候注意几点:支持的模型够不够多(我需要同时用 Claude + Gemini + DeepSeek)、计费是否透明、余额会不会过期。

我用的是 api2everything.xyz,注册送 ¥1,余额永久不过期,够试很久。300+ 模型,OpenAI 格式兼容,改 baseURL 就能用,SVIP 折扣下来比官方便宜 65% 左右。

有类似账单压力的可以试试,反正注册免费。