省钱实战 · 阅读约 3 分钟

月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行 baseURL 后账单直接砍掉 70%

结论先说:把 API 请求打到中转服务,同样的模型、同样的用量,账单少了大半。


痛点

我有个内部工具,每天跑几百次 Claude Sonnet 做文档摘要 + 代码 review。上个月账单 $210,看着有点肉疼。

问题不是用量大,是用错了模型。很多任务根本不需要 Sonnet,Haiku 完全够用,但懒得改代码,就一直跑着。加上 Anthropic 官方不支持国内直连,还得挂代理,偶尔超时重试,实际成本更高。


具体怎么改

第一步:换 baseURL

無量Api,它兼容 OpenAI 格式,Anthropic 的模型也走同一套接口。改动只有一行:


import anthropic



client = anthropic.Anthropic(

    api_key="你的中转 key",

    base_url="https://api2everything.xyz/v1",

)

或者用 openai SDK 直接调 Claude:


from openai import OpenAI



client = OpenAI(

    api_key="你的中转 key",

    base_url="https://api2everything.xyz/v1",

)



response = client.chat.completions.create(

    model="claude-3-5-haiku-20241022",

    messages=[{"role": "user", "content": "帮我总结这段代码的作用"}],

)

print(response.choices[0].message.content)

第二步:按任务选模型

我把任务分了三档:

| 任务类型 | 原来用 | 现在用 | 价格对比 |

|---|---|---|---|

| 长文档摘要 | Sonnet | Haiku | 省 ~80% |

| 代码 review | Sonnet | Sonnet(保留) | — |

| 简单问答/分类 | Sonnet | Haiku / GPT-4o-mini | 省 ~85% |

Haiku 处理摘要类任务完全没问题,速度还更快。

第三步:curl 快速验证


curl https://api2everything.xyz/v1/chat/completions \

  -H "Authorization: Bearer 你的key" \

  -H "Content-Type: application/json" \

  -d '{

    "model": "claude-3-5-haiku-20241022",

    "messages": [{"role": "user", "content": "hello"}],

    "max_tokens": 50

  }'

跑通了再接进项目,5 分钟的事。


结果

改完之后这个月账单折合人民币大概 ¥180,之前要 ¥1500+。主要省在两块:一是中转本身比官方便宜(官方价打 65 折左右,SVIP 还有 7.7 折),二是模型降级带来的额外节省。

代理也不用挂了,国内直连,超时重试的情况基本消失。


我用的中转是 api2everything.xyz,注册送 ¥1,余额永久不过期,够试很久。支持 300+ 模型,OpenAI / Claude / Gemini / DeepSeek 都有,改一行 baseURL 直接接上。