月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%
月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%
结论先说:把 API 请求打到中转服务,同样的模型、同样的用量,账单少了大半。
痛点
我有个内部工具,每天跑几百次 Claude Sonnet 做文档摘要 + 代码 review。上个月账单 $210,看着有点肉疼。
问题不是用量大,是用错了模型。很多任务根本不需要 Sonnet,Haiku 完全够用,但懒得改代码,就一直跑着。加上 Anthropic 官方不支持国内直连,还得挂代理,偶尔超时重试,实际成本更高。
具体怎么改
第一步:换 baseURL
用 無量Api,它兼容 OpenAI 格式,Anthropic 的模型也走同一套接口。改动只有一行:
import anthropic
client = anthropic.Anthropic(
api_key="你的中转 key",
base_url="https://api2everything.xyz/v1",
)
或者用 openai SDK 直接调 Claude:
from openai import OpenAI
client = OpenAI(
api_key="你的中转 key",
base_url="https://api2everything.xyz/v1",
)
response = client.chat.completions.create(
model="claude-3-5-haiku-20241022",
messages=[{"role": "user", "content": "帮我总结这段代码的作用"}],
)
print(response.choices[0].message.content)
第二步:按任务选模型
我把任务分了三档:
| 任务类型 | 原来用 | 现在用 | 价格对比 |
|---|---|---|---|
| 长文档摘要 | Sonnet | Haiku | 省 ~80% |
| 代码 review | Sonnet | Sonnet(保留) | — |
| 简单问答/分类 | Sonnet | Haiku / GPT-4o-mini | 省 ~85% |
Haiku 处理摘要类任务完全没问题,速度还更快。
第三步:curl 快速验证
curl https://api2everything.xyz/v1/chat/completions \
-H "Authorization: Bearer 你的key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-3-5-haiku-20241022",
"messages": [{"role": "user", "content": "hello"}],
"max_tokens": 50
}'
跑通了再接进项目,5 分钟的事。
结果
改完之后这个月账单折合人民币大概 ¥180,之前要 ¥1500+。主要省在两块:一是中转本身比官方便宜(官方价打 65 折左右,SVIP 还有 7.7 折),二是模型降级带来的额外节省。
代理也不用挂了,国内直连,超时重试的情况基本消失。
我用的中转是 api2everything.xyz,注册送 ¥1,余额永久不过期,够试很久。支持 300+ 模型,OpenAI / Claude / Gemini / DeepSeek 都有,改一行 baseURL 直接接上。