省钱实战 · 阅读约 3 分钟

月花 $200 调 Claude 的我,改了一行 Base URL 后账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行 Base URL 后账单直接砍掉 70%

结论先说:把 API 请求转到国内中转,同等模型便宜 65%,延迟还比官方低。


痛点

上个月账单出来,Claude API $187,其中 claude-sonnet-4 占了大头。我的场景是代码 review + 文档生成,每次请求 context 都很长,input token 烧得飞快。

更烦的是:

  • 官方需要绑美国信用卡,汇率损耗 + 手续费又是一层
  • 国内网络直连不稳,偶尔超时要加重试逻辑
  • 充值额度用不完还担心账号被封,钱打水漂

想过用 Haiku/Flash 这类便宜模型降级,但有些任务质量差距明显,不能无脑换。


怎么改的

第一步:换 Base URL,其他代码不动

我用的是 無量Api,OpenAI 格式兼容,改一行:


from openai import OpenAI



client = OpenAI(

    api_key="你的中转 key",

    base_url="https://api2everything.xyz/v1",  # 只改这里

)



response = client.chat.completions.create(

    model="claude-sonnet-4-5",  # 模型名和官方一致

    messages=[{"role": "user", "content": "review 这段代码..."}],

)

curl 版本:


curl https://api2everything.xyz/v1/chat/completions \

  -H "Authorization: Bearer 你的key" \

  -H "Content-Type: application/json" \

  -d '{

    "model": "claude-sonnet-4-5",

    "messages": [{"role": "user", "content": "hello"}]

  }'

就这样,其他逻辑一行不动。

第二步:按任务选模型,不要无脑用旗舰

我现在的分层策略:

| 任务 | 模型 | 理由 |

|------|------|------|

| 代码补全、简单问答 | claude-haiku-4-5 | 够用,便宜 10 倍 |

| 代码 review、文档生成 | claude-sonnet-4-5 | 性价比最高 |

| 复杂推理、架构设计 | claude-opus-4-5 | 按需用,不常开 |

以前我懒,全部请求都打 Opus,现在 Haiku 承接了 60% 的流量,账单自然下来了。

第三步:加个简单的 token 预估,超长 context 截断


import tiktoken



def trim_messages(messages, max_tokens=8000):

    enc = tiktoken.get_encoding("cl100k_base")

    total = 0

    trimmed = []

    for msg in reversed(messages):

        tokens = len(enc.encode(msg["content"]))

        if total + tokens > max_tokens:

            break

        trimmed.insert(0, msg)

        total += tokens

    return trimmed

context 窗口塞满是最大的隐形成本,很多人没意识到。


效果

这个月账单折合人民币大概 ¥380,上个月同等用量是 ¥1350+。主要省在两块:中转价格本身便宜 65%,加上模型分层后旗舰模型用量降了一半。

无量 Api 支持 300+ 模型,DeepSeek、Gemini、GPT-4o 都有,注册送 ¥1,余额永久不过期,够跑不少测试请求了。

👉 https://api2everything.xyz/?utm_source=v2ex&utm_medium=article&utm_campaign=daily&aff=wqUb