月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%
月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%
结论先说:把 base_url 换掉,同样的代码跑同样的模型,费用能省 60-70%。
痛点
上个月账单出来,Claude API 花了将近 $200。细看了一下,大头是 claude-opus-4 的 input token,项目里有个地方偷懒,所有请求都走 Opus,包括一些根本不需要强模型的分类、摘要任务。
官方价格摆在那里:claude-opus-4 input $15/M tokens,claude-haiku-3-5 才 $0.8/M。同样的任务,差了将近 20 倍。
问题不是"用了贵的模型",而是懒得分流——所有请求一刀切走 Opus,图省事,结果账单炸了。
两步操作
第一步:分流模型
把任务按复杂度拆开。我的项目大概是这个比例:
- 意图分类、关键词提取 →
claude-haiku-3-5 - 普通问答、代码补全 →
claude-sonnet-4 - 复杂推理、长文档分析 →
claude-opus-4(真正需要的时候才用)
实际跑下来,80% 的请求都能走 Haiku,Opus 的调用量从每天几千次降到几百次。
第二步:换 base_url
官方直连在国内本来就不稳,加上价格问题,换中转是顺理成章的事。我现在用的是 无量Api,价格比官方便宜 65% 左右,SVIP 还有 7.7 折,格式完全兼容 OpenAI SDK,改一行就完事。
from anthropic import Anthropic
client = Anthropic(
api_key="your-key-here",
base_url="https://api2everything.xyz/v1", # 就改这一行
)
# 其余代码完全不动
response = client.messages.create(
model="claude-haiku-3-5-20241022",
max_tokens=1024,
messages=[{"role": "user", "content": "帮我提取这段文本的关键词"}],
)
用 curl 验证一下连通性:
curl https://api2everything.xyz/v1/models \
-H "Authorization: Bearer your-key-here" \
-H "Content-Type: application/json"
能返回模型列表就说明通了,之后正常跑业务代码即可。
实际效果
改完之后跑了两周,同样的业务量:
| 项目 | 改前 | 改后 |
|------|------|------|
| 月均费用 | ~$200 | ~$55 |
| Opus 占比 | 95% | 12% |
| 延迟 | 偶尔超时 | 稳定 |
省下来的钱够多跑几个新项目了。
顺带一提
无量Api 支持 300+ 模型,OpenAI / Claude / Gemini / DeepSeek 都有,注册送 ¥1 余额,够把上面的 curl 跑个几十次验证环境。余额永久有效,不用担心过期浪费。