月花 $200 调 Claude 的我,改了一行代码现在只花 $60
月花 $200 调 Claude 的我,改了一行代码现在只花 $60
结论先说:把 base_url 换掉,账单直接砍到三分之一。
背景
我有个内部工具,每天跑几百次 Claude Sonnet 做文档摘要 + 代码审查。上个月账单 $210,看着有点肉疼。
问题不是用量大,是用错了模型。
具体说:
- 代码审查我一直用
claude-sonnet-4,其实大部分 diff 根本不需要这个级别 - 文档摘要更离谱,纯提取关键词,我在用 Sonnet 做 Haiku 的活
- 官方 API 没有折扣,老老实实按 token 计费
怎么改的
第一步:模型降级
把文档摘要全换成 claude-haiku-3-5,代码审查只有涉及架构变更的 PR 才走 Sonnet,日常小改动走 Haiku。
这一步就省了大概 40%。
第二步:换 base_url
官方价格没得谈,但中转服务有折扣。我现在用的是 无量 API,兼容 OpenAI 格式,改一行就完事:
from anthropic import Anthropic
client = Anthropic(
api_key="你的中转 key",
base_url="https://api2everything.xyz/v1",
)
或者用 OpenAI SDK 也行,因为接口格式一样:
from openai import OpenAI
client = OpenAI(
api_key="你的中转 key",
base_url="https://api2everything.xyz/v1",
)
response = client.chat.completions.create(
model="claude-haiku-3-5",
messages=[{"role": "user", "content": "帮我总结这段文档:..."}],
max_tokens=512,
)
print(response.choices[0].message.content)
curl 版本:
curl https://api2everything.xyz/v1/chat/completions \
-H "Authorization: Bearer 你的key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-3-5",
"messages": [{"role": "user", "content": "总结以下内容:..."}],
"max_tokens": 512
}'
第三步:加 token 上限
之前没设 max_tokens,偶尔模型抽风输出一大段废话,白白多花钱。现在摘要任务统一限 512,代码审查限 1024,基本够用。
算一下账
| 任务 | 之前 | 之后 |
|------|------|------|
| 文档摘要 | Sonnet,$3/M tokens | Haiku,$0.25/M tokens |
| 代码审查 | 全走 Sonnet | 80% Haiku,20% Sonnet |
| 价格折扣 | 官方原价 | 中转约 65% off |
上个月账单从 $210 降到 $63,用量没变。
几个注意点
- 中转服务稳定性要自己测,我跑了两周没出过问题,延迟比直连官方还低(国内直连,不用梯子)
- 模型别乱降,有些任务 Haiku 真的不够用,先小批量测效果再全量切
- 余额按需充,无量这个余额永久有效,不用担心过期
我用的中转是 api2everything.xyz,注册送 ¥1,够试很久。支持 Claude / GPT / Gemini / DeepSeek,300+ 模型,改个 base_url 直接用。