月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%
月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%
结论先说:把 base_url 换掉,同样的代码跑同样的模型,费用能省 60-70%。
痛点
我有个每天跑的代码审查 pipeline,用 Claude Sonnet 批量处理 PR diff,高峰期一个月 API 账单能到 $180-200。
Anthropic 官方没有便宜的路子,充值还要信用卡,汇率加手续费再损耗一截。更烦的是,有时候额度用完了,凌晨任务直接挂掉,第二天才发现。
后来我换了中转服务,同样的 token 用量,上个月账单折合人民币不到 400 块。
具体怎么操作
第一步:改 base_url,其他代码不动
用 anthropic SDK 的话:
import anthropic
client = anthropic.Anthropic(
api_key="你的中转 key",
base_url="https://api.api2everything.xyz",
)
response = client.messages.create(
model="claude-sonnet-4-5",
max_tokens=1024,
messages=[{"role": "user", "content": "review this diff: ..."}],
)
print(response.content[0].text)
或者用 OpenAI 兼容格式(很多中转都支持,更通用):
from openai import OpenAI
client = OpenAI(
api_key="你的中转 key",
base_url="https://api.api2everything.xyz/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-4-5",
messages=[{"role": "user", "content": "review this diff: ..."}],
)
print(response.choices[0].message.content)
curl 版本:
curl https://api.api2everything.xyz/v1/chat/completions \
-H "Authorization: Bearer 你的key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-4-5",
"messages": [{"role": "user", "content": "hello"}]
}'
第二步:非核心任务降级到 Haiku
我的 pipeline 里有一步是「判断这个 PR 是否值得深度审查」,这个分类任务根本不需要 Sonnet,换成 claude-haiku-4-5 价格差了将近 10 倍。
def should_deep_review(diff: str) -> bool:
# 用便宜模型做初筛
resp = client.chat.completions.create(
model="claude-haiku-4-5", # 便宜 10x
messages=[{
"role": "user",
"content": f"这个 diff 改动超过 50 行或涉及核心逻辑吗?只回答 yes/no。\n{diff[:500]}"
}],
max_tokens=5,
)
return resp.choices[0].message.content.strip().lower() == "yes"
初筛过滤掉 60% 的 trivial PR,剩下的才走 Sonnet 深度审查。
省钱效果
| 场景 | 之前 | 之后 |
|------|------|------|
| 月均 token 用量 | 不变 | 不变 |
| 月均费用 | ~$190 | ~¥380 |
| 汇率/手续费损耗 | 有 | 无 |
| 额度用完挂任务 | 偶发 | 余额永久有效,不过期 |
注意事项
- 中转服务选的时候看一下是否支持你用的模型,我用的这家支持 300+ 模型,Claude/GPT/Gemini/DeepSeek 都有
- 代码里
base_url建议走环境变量,方便随时切回官方 - 批量任务加个 retry + 限速,别一次打爆 rate limit
我用的中转是 api2everything.xyz,注册送 ¥1,够跑几百次 Haiku 调用,试试水没什么成本。SVIP 是 7.7 折,量大的话比官方便宜 65% 左右。