省钱实战 · 阅读约 3 分钟

月花 200 刀调 Claude 的我,改了一行 Base URL 后现在只花 60

月花 200 刀调 Claude 的我,改了一行 Base URL 后现在只花 60

结论先说:把 Claude API 请求转到国内中转,账单直接掉到原来的三分之一,延迟反而更稳。


痛点

之前做一个文档处理工具,核心是 Claude Sonnet 跑长上下文提取。每天跑几百个文档,input token 量上去很快,月底账单 200 刀出头,美国信用卡手续费再加一刀。

更烦的是——国内直连 Anthropic 本来就不稳,经常 timeout,程序还要加重试逻辑,稍不注意就重复扣费。

后来一个同事说他在用国内中转,我当时觉得"能安全吗""模型是不是被改过"之类的,拖了两个月没动。直到有一次账单到 220 刀,才认真看了一下。


操作就一步

找一个兼容 OpenAI 格式的中转服务(我用的是 无量API),把 base_url 换掉,其他代码一行不动。

Python 示例:


from anthropic import Anthropic



client = Anthropic(

    api_key="你的中转 API Key",

    base_url="https://api2everything.xyz",  # 改这一行

)



response = client.messages.create(

    model="claude-sonnet-4-5",

    max_tokens=1024,

    messages=[{"role": "user", "content": "帮我提取文档关键信息"}],

)

print(response.content[0].text)

如果你是直接用 curl 测试:


curl https://api2everything.xyz/v1/messages \

  -H "x-api-key: 你的中转Key" \

  -H "anthropic-version: 2023-06-01" \

  -H "content-type: application/json" \

  -d '{

    "model": "claude-sonnet-4-5",

    "max_tokens": 1024,

    "messages": [{"role": "user", "content": "hello"}]

  }'


进一步省:分级用模型

文档处理场景里,不是每个步骤都需要 Sonnet。我后来把流程拆了一下:

  • 粗筛、格式判断、简单分类 → 用 claude-haiku-4-5,速度快,价格是 Sonnet 的十分之一
  • 核心语义提取、复杂推理 → 才上 Sonnet

拆完之后 token 消耗里 Haiku 占了 70%,Sonnet 只处理真正需要的部分。这一步比换 Base URL 省的还多。


账单对比

| 阶段 | 月均费用 |

|------|----------|

| 直连官方 + 全用 Sonnet | ~220 刀 |

| 中转 + 全用 Sonnet | ~80 刀 |

| 中转 + Haiku/Sonnet 分级 | ~60 刀 |

三个月稳定跑下来,没出现过模型返回异常,响应格式和官方完全一致(毕竟就是透传)。


补充

中转服务选的时候主要看两点:一是支持的模型够不够全(我还要跑 GPT-4o 和 Gemini 做对比测试),二是余额机制——有些平台余额会过期,充多了浪费。

我用的这家注册送 ¥1,余额永久有效,按量付费,不用担心账期问题。

👉 api2everything.xyz,注册送 ¥1,够试很久。