省钱实战 · 阅读约 3 分钟

月花 $200 调 Claude 的我,改了一个参数后现在只花 $60

月花 $200 调 Claude 的我,改了一个参数后现在只花 $60

结论先说:把 base_url 从 api.anthropic.com 改到中转,账单直接打三折。


起因

上个月账单出来,Claude API 花了 $210。细看了一下,大头不是 Sonnet,是我开发阶段随手用的那些测试请求——prompt 没优化、context 带太多历史记录、有几个 agent 循环还在跑 Opus。

问题很典型:开发阶段用生产级模型,钱烧得很快。

官方价格摆着:Claude 3.5 Sonnet 输入 $3/M tokens,Opus $15/M。开发调试的时候根本不在乎,跑完一看账单才知道疼。


怎么降的

第一步:区分"开发调用"和"生产调用"

开发阶段大量调用,目的是验证 prompt 逻辑,不需要最强模型。我做了个简单分层:

  • 开发 / 调试:claude-haiku-3-5,便宜 10 倍以上
  • staging 测试:claude-sonnet-4
  • 生产:按需选,但 context 严格截断

光这一条,测试消耗就降了 70%。

第二步:换中转,同模型再省 35%

官方直连在国内还得挂代理,有时候不稳定。我现在用的是 无量 API,支持 Claude / OpenAI / Gemini / DeepSeek 等 300+ 模型,国内直连,价格比官方便宜 65%,SVIP 还有 7.7 折。

迁移成本接近零,就改一行:


import anthropic



client = anthropic.Anthropic(

    api_key="your-key-here",

    base_url="https://api2everything.xyz",  # 就这一行

)



response = client.messages.create(

    model="claude-haiku-3-5",

    max_tokens=1024,

    messages=[{"role": "user", "content": "hello"}],

)

print(response.content)

或者 curl 确认一下能不能通:


curl https://api2everything.xyz/v1/messages \

  -H "x-api-key: $API_KEY" \

  -H "anthropic-version: 2023-06-01" \

  -H "content-type: application/json" \

  -d '{

    "model": "claude-haiku-3-5",

    "max_tokens": 256,

    "messages": [{"role": "user", "content": "ping"}]

  }'


现在每月大概花多少

| 场景 | 之前 | 现在 |

|------|------|------|

| 开发调试 | Sonnet,官方价 | Haiku,中转价 |

| 生产推理 | Opus 跑满 | Sonnet 按需 |

| 合计估算 | ~$210 | ~$58 |

没有魔法,就是模型选对 + 价格打下来。


几个额外的小节省

  • max_tokens 别乱设大,按实际需要给,计费是实际输出 token
  • system prompt 复用,不要每次都把文档全量塞进去
  • 批量非实时任务可以走 batch API,官方有 50% 折扣,中转也支持

我用的中转是 api2everything.xyz,注册送 ¥1,余额永久不过期,够把上面的 curl 跑几百次了。

👉 https://api2everything.xyz/?utm_source=v2ex&utm_medium=article&utm_campaign=daily&aff=wqUb