省钱实战 · 阅读约 2 分钟

月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%

月花 $200 调 Claude 的我,改了一行代码后账单直接砍掉 70%

结论先说:把 base_url 换掉,同样的代码跑同样的模型,费用能省 60-70%。


痛点

上个月账单出来,Claude API 花了将近 $200。细看了一下,大头是 claude-opus-4 的 input token,项目里有个地方偷懒,所有请求都走 Opus,包括一些根本不需要强模型的分类、摘要任务。

官方价格摆在那里:claude-opus-4 input $15/M tokens,claude-haiku-3-5 才 $0.8/M。同样的任务,差了将近 20 倍。

问题不是"用了贵的模型",而是懒得分流——所有请求一刀切走 Opus,图省事,结果账单炸了。


两步操作

第一步:分流模型

把任务按复杂度拆开。我的项目大概是这个比例:

  • 意图分类、关键词提取 → claude-haiku-3-5
  • 普通问答、代码补全 → claude-sonnet-4
  • 复杂推理、长文档分析 → claude-opus-4(真正需要的时候才用)

实际跑下来,80% 的请求都能走 Haiku,Opus 的调用量从每天几千次降到几百次。

第二步:换 base_url

官方直连在国内本来就不稳,加上价格问题,换中转是顺理成章的事。我现在用的是 无量Api,价格比官方便宜 65% 左右,SVIP 还有 7.7 折,格式完全兼容 OpenAI SDK,改一行就完事。


from anthropic import Anthropic



client = Anthropic(

    api_key="your-key-here",

    base_url="https://api2everything.xyz/v1",  # 就改这一行

)



# 其余代码完全不动

response = client.messages.create(

    model="claude-haiku-3-5-20241022",

    max_tokens=1024,

    messages=[{"role": "user", "content": "帮我提取这段文本的关键词"}],

)

用 curl 验证一下连通性:


curl https://api2everything.xyz/v1/models \

  -H "Authorization: Bearer your-key-here" \

  -H "Content-Type: application/json"

能返回模型列表就说明通了,之后正常跑业务代码即可。


实际效果

改完之后跑了两周,同样的业务量:

| 项目 | 改前 | 改后 |

|------|------|------|

| 月均费用 | ~$200 | ~$55 |

| Opus 占比 | 95% | 12% |

| 延迟 | 偶尔超时 | 稳定 |

省下来的钱够多跑几个新项目了。


顺带一提

无量Api 支持 300+ 模型,OpenAI / Claude / Gemini / DeepSeek 都有,注册送 ¥1 余额,够把上面的 curl 跑个几十次验证环境。余额永久有效,不用担心过期浪费。

地址:https://api2everything.xyz