月账单从 $200 砍到 $60,就改了一个参数
月账单从 $200 砍到 $60,就改了一个参数
结论先说:把 base_url 换掉,顺手把模型名改成便宜别名,账单直接三折。
背景
我的场景是给内部工具接 Claude,主要是代码 review 和文档总结,每天跑几百次请求。
用官方 API 的时候没太在意,月底一看账单 $190+,被自己吓到了。
拆了一下 usage log:
- 90% 的请求是「摘要/分类/格式化」这种没那么重的任务
- 这些请求我全在用
claude-sonnet-4,完全没必要 - 另外国内访问官方 endpoint 要挂代理,偶尔超时重试,又多了一堆浪费的 token
操作
第一步,换 base_url
from anthropic import Anthropic
client = Anthropic(
api_key="你的key",
base_url="https://api.api2everything.xyz", # 改这一行
)
OpenAI SDK 同理:
from openai import OpenAI
client = OpenAI(
api_key="你的key",
base_url="https://api.api2everything.xyz/v1",
)
其他代码一行不动,接口格式完全兼容。
第二步,区分任务,用对模型
我之前图省事,所有请求统一走 Sonnet。现在按重要程度分流:
| 任务类型 | 之前 | 现在 |
|---|---|---|
| 代码架构分析、复杂推理 | claude-sonnet-4 | claude-sonnet-4(保留) |
| 文档摘要、分类打标 | claude-sonnet-4 | claude-haiku-4 |
| 格式转换、简单改写 | claude-sonnet-4 | gemini-2.0-flash |
Haiku 和 Flash 的价格大概是 Sonnet 的 1/8 到 1/10,质量对轻任务来说够用。
第三步,curl 测一下通不通
curl https://api.api2everything.xyz/v1/chat/completions \
-H "Authorization: Bearer 你的key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-4-5",
"messages": [{"role": "user", "content": "hello"}],
"max_tokens": 50
}'
通了就行,直连不需要代理,延迟反而比我之前挂代理打官方快不少。
结果
改完之后跑了一个月:
- Haiku/Flash 承接了大约 85% 的请求量
- Sonnet 只处理真正需要推理的部分
- 总花费从 $190 降到 $58
没改任何业务逻辑,只动了 base_url 和模型名。
最后
我用的中转是 api2everything.xyz,注册送 ¥1,余额永久不过期,够你先把上面那个 curl 跑通再说。
支持 OpenAI / Claude / Gemini / DeepSeek 这些,SVIP 的话价格是官方的 7.7 折,普通也比官方便宜不少。