月花 200 刀调 Claude 的我,改了一行 Base URL 后现在只花 60
月花 200 刀调 Claude 的我,改了一行 Base URL 后现在只花 60
结论先说:把 Claude API 请求转到国内中转,账单直接掉到原来的三分之一,延迟反而更稳。
痛点
之前做一个文档处理工具,核心是 Claude Sonnet 跑长上下文提取。每天跑几百个文档,input token 量上去很快,月底账单 200 刀出头,美国信用卡手续费再加一刀。
更烦的是——国内直连 Anthropic 本来就不稳,经常 timeout,程序还要加重试逻辑,稍不注意就重复扣费。
后来一个同事说他在用国内中转,我当时觉得"能安全吗""模型是不是被改过"之类的,拖了两个月没动。直到有一次账单到 220 刀,才认真看了一下。
操作就一步
找一个兼容 OpenAI 格式的中转服务(我用的是 无量API),把 base_url 换掉,其他代码一行不动。
Python 示例:
from anthropic import Anthropic
client = Anthropic(
api_key="你的中转 API Key",
base_url="https://api2everything.xyz", # 改这一行
)
response = client.messages.create(
model="claude-sonnet-4-5",
max_tokens=1024,
messages=[{"role": "user", "content": "帮我提取文档关键信息"}],
)
print(response.content[0].text)
如果你是直接用 curl 测试:
curl https://api2everything.xyz/v1/messages \
-H "x-api-key: 你的中转Key" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-4-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "hello"}]
}'
进一步省:分级用模型
文档处理场景里,不是每个步骤都需要 Sonnet。我后来把流程拆了一下:
- 粗筛、格式判断、简单分类 → 用
claude-haiku-4-5,速度快,价格是 Sonnet 的十分之一 - 核心语义提取、复杂推理 → 才上 Sonnet
拆完之后 token 消耗里 Haiku 占了 70%,Sonnet 只处理真正需要的部分。这一步比换 Base URL 省的还多。
账单对比
| 阶段 | 月均费用 |
|------|----------|
| 直连官方 + 全用 Sonnet | ~220 刀 |
| 中转 + 全用 Sonnet | ~80 刀 |
| 中转 + Haiku/Sonnet 分级 | ~60 刀 |
三个月稳定跑下来,没出现过模型返回异常,响应格式和官方完全一致(毕竟就是透传)。
补充
中转服务选的时候主要看两点:一是支持的模型够不够全(我还要跑 GPT-4o 和 Gemini 做对比测试),二是余额机制——有些平台余额会过期,充多了浪费。
我用的这家注册送 ¥1,余额永久有效,按量付费,不用担心账期问题。
👉 api2everything.xyz,注册送 ¥1,够试很久。