月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%
月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%
结论先说:把 API 请求转到国内中转,同样的用量,账单从 $200 掉到 $60 以内。
痛点
我有个每天跑的代码审查 pipeline,用 Claude Sonnet 处理 PR diff,再加上偶尔跑的 long-context 文档分析,上个月 Anthropic 账单 $210,加上 OpenAI 的 $40,合计 $250。
更烦的是:国内直连 Anthropic 本来就不稳,还得挂代理,延迟高,偶尔 timeout 导致任务重跑,重跑又多花 token。恶性循环。
操作
核心就两步。
第一步:换 baseURL
以 Python SDK 为例,原来是:
import anthropic
client = anthropic.Anthropic(api_key="sk-ant-xxx")
改成:
import anthropic
client = anthropic.Anthropic(
api_key="你的中转key",
base_url="https://api.api2everything.xyz",
)
就这一行。其他代码不动。
用 OpenAI SDK 调 Claude 的同学(openai 格式兼容):
from openai import OpenAI
client = OpenAI(
api_key="你的中转key",
base_url="https://api.api2everything.xyz/v1",
)
resp = client.chat.completions.create(
model="claude-sonnet-4-5", # 直接用模型名
messages=[{"role": "user", "content": "review this diff: ..."}],
max_tokens=1024,
)
print(resp.choices[0].message.content)
curl 版本:
curl https://api.api2everything.xyz/v1/chat/completions \
-H "Authorization: Bearer 你的中转key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-4-5",
"messages": [{"role": "user", "content": "hello"}],
"max_tokens": 256
}'
第二步:按任务选模型
这才是省钱的大头。我之前所有任务无脑用 Sonnet,其实完全没必要。
| 任务类型 | 原来用 | 现在用 | 省多少 |
|---|---|---|---|
| PR diff 审查(短文本)| claude-sonnet-4-5 | claude-haiku-4-5 | ~80% |
| 文档摘要 | claude-sonnet-4-5 | gemini-2.0-flash | ~75% |
| 复杂推理/架构分析 | claude-sonnet-4-5 | claude-sonnet-4-5 | 不变 |
Haiku 处理代码审查完全够用,速度还更快。Gemini Flash 做摘要性价比极高。只有真正需要强推理的任务才上 Sonnet。
实际效果
同样的 pipeline 跑了一个月:
- token 用量没变
- 账单从 $210 → 约 ¥420(折合 $58 左右)
- 延迟反而更低,国内直连比挂代理稳
补充
中转服务选的时候注意几点:支持的模型够不够多(我需要同时用 Claude + Gemini + DeepSeek)、计费是否透明、余额会不会过期。
我用的是 api2everything.xyz,注册送 ¥1,余额永久不过期,够试很久。300+ 模型,OpenAI 格式兼容,改 baseURL 就能用,SVIP 折扣下来比官方便宜 65% 左右。
有类似账单压力的可以试试,反正注册免费。