省钱实战 · 阅读约 3 分钟

月花 $200 调 Claude 的我,改了一行 base_url 后账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行 base_url 后账单直接砍掉 70%

结论先说:把 API 请求从官方端点切到中转,同等用量账单从 $200 掉到不到 $60。


痛点

我有个内部工具,核心逻辑是把用户上传的文档喂给 Claude,提取结构化字段,再写回数据库。流量不算大,日均大概 400-600 次请求,但每次都带着完整上下文,token 消耗很可观。

上个月账单出来:$213。

仔细一拆,大头是 claude-sonnet-4-5,我当时图省事所有请求都走这个,包括一些明显不需要高智能的任务,比如格式校验、字段归一化、简单分类。这些任务完全可以用更便宜的模型跑。

问题有两个:

1. 模型选型太懒,全堆旗舰

2. 官方定价没有折扣,量不够打不到折


具体怎么改

第一步:任务分层

把请求按复杂度分成两类:

  • 复杂推理、长文档理解 → 继续用 claude-sonnet
  • 格式转换、简单分类、字段校验 → 换 claude-haiku-3

claude-haiku-3 的定价大概是 sonnet 的 1/10 不到,处理简单任务速度还更快。

第二步:换 base_url

官方没有折扣,但中转服务比官方便宜 65%,且是标准 OpenAI 格式兼容。改动只需要一行:


import anthropic



client = anthropic.Anthropic(

    api_key="你的中转 key",

    base_url="https://api2everything.xyz/v1",  # 改这一行

)



# 其余代码不动

response = client.messages.create(

    model="claude-haiku-3-5",  # 简单任务换 haiku

    max_tokens=512,

    messages=[{"role": "user", "content": "从下面文本提取日期字段:..."}]

)

如果你用 curl 测试:


curl https://api2everything.xyz/v1/messages \

  -H "x-api-key: 你的key" \

  -H "anthropic-version: 2023-06-01" \

  -H "content-type: application/json" \

  -d '{

    "model": "claude-haiku-3-5",

    "max_tokens": 256,

    "messages": [{"role": "user", "content": "hello"}]

  }'

格式跟官方完全一样,迁移成本基本为零。


算下来省了多少

| 任务类型 | 原来 | 现在 |

|---|---|---|

| 复杂文档解析 (20%) | sonnet 官方价 | sonnet 中转 (65% off) |

| 简单字段提取 (80%) | sonnet 官方价 | haiku 中转 (65% off) |

两个改动叠加,上个月同等用量跑出来 $58。

主要贡献来自模型分层,haiku 处理简单任务省了大头;中转折扣是额外加成。


几个注意点

  • 中转服务要选支持国内直连的,否则延迟会反噬——我之前踩过一个海外中转,P99 延迟 8 秒,不如直连官方
  • 批量任务可以考虑 Batch API,再便宜一半,但有延迟(24h 内返回),同步场景不适用
  • 余额管理:官方账单按月结,中转一般预充值,小额充着用,跑量前先压测一下

我用的中转是 api2everything.xyz,支持 300+ 模型(OpenAI / Claude / Gemini / DeepSeek 都有),注册送 ¥1,够拿来跑几百次 haiku 请求试试手感,余额永久不过期。

→ https://api2everything.xyz/?utm_source=v2ex&utm_medium=article&utm_campaign=daily&aff=wqUb