月花 $200 调 Claude 的我,改了一个参数后现在只花 $60
月花 $200 调 Claude 的我,改了一个参数后现在只花 $60
结论先说:把 base_url 从 api.anthropic.com 改到中转,账单直接打三折。
起因
上个月账单出来,Claude API 花了 $210。细看了一下,大头不是 Sonnet,是我开发阶段随手用的那些测试请求——prompt 没优化、context 带太多历史记录、有几个 agent 循环还在跑 Opus。
问题很典型:开发阶段用生产级模型,钱烧得很快。
官方价格摆着:Claude 3.5 Sonnet 输入 $3/M tokens,Opus $15/M。开发调试的时候根本不在乎,跑完一看账单才知道疼。
怎么降的
第一步:区分"开发调用"和"生产调用"
开发阶段大量调用,目的是验证 prompt 逻辑,不需要最强模型。我做了个简单分层:
- 开发 / 调试:
claude-haiku-3-5,便宜 10 倍以上 - staging 测试:
claude-sonnet-4 - 生产:按需选,但 context 严格截断
光这一条,测试消耗就降了 70%。
第二步:换中转,同模型再省 35%
官方直连在国内还得挂代理,有时候不稳定。我现在用的是 无量 API,支持 Claude / OpenAI / Gemini / DeepSeek 等 300+ 模型,国内直连,价格比官方便宜 65%,SVIP 还有 7.7 折。
迁移成本接近零,就改一行:
import anthropic
client = anthropic.Anthropic(
api_key="your-key-here",
base_url="https://api2everything.xyz", # 就这一行
)
response = client.messages.create(
model="claude-haiku-3-5",
max_tokens=1024,
messages=[{"role": "user", "content": "hello"}],
)
print(response.content)
或者 curl 确认一下能不能通:
curl https://api2everything.xyz/v1/messages \
-H "x-api-key: $API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-3-5",
"max_tokens": 256,
"messages": [{"role": "user", "content": "ping"}]
}'
现在每月大概花多少
| 场景 | 之前 | 现在 |
|------|------|------|
| 开发调试 | Sonnet,官方价 | Haiku,中转价 |
| 生产推理 | Opus 跑满 | Sonnet 按需 |
| 合计估算 | ~$210 | ~$58 |
没有魔法,就是模型选对 + 价格打下来。
几个额外的小节省
max_tokens别乱设大,按实际需要给,计费是实际输出 token- system prompt 复用,不要每次都把文档全量塞进去
- 批量非实时任务可以走 batch API,官方有 50% 折扣,中转也支持
我用的中转是 api2everything.xyz,注册送 ¥1,余额永久不过期,够把上面的 curl 跑几百次了。
👉 https://api2everything.xyz/?utm_source=v2ex&utm_medium=article&utm_campaign=daily&aff=wqUb