低成本不是"用最便宜的模型"
真正拉高成本的,往往是:
- 长上下文(对话越长,每次调用越贵)
- 多工具同时挂载(每次都要发完整工具描述)
- fallback 过宽(主模型失败后反复重试贵模型)
- 重复推理(循环任务没设迭代上限)
第一步:设好硬限额
不管你用什么模型,先把防线设好:
openclaw config set ai.dailyLimit 1000
openclaw config set ai.monthlyBudget 50
验证配置:
openclaw config list | grep -E "dailyLimit|monthlyBudget"
这两个参数不是"等出事了再设",而是第一天就应该有。
第二步:选对模型路线
不同任务用不同档位的模型,是最直接的省钱方式:
| 任务类型 | 推荐路线 | 原因 |
|---|---|---|
| 简单对话、日报整理 | DeepSeek / 智谱 GLM | 成本低,中文能力够用 |
| 复杂推理、代码生成 | Claude / GPT-4o | 质量高但成本也高,按需使用 |
| 翻译、摘要、分类 | 通义千问 / Kimi | 性价比好 |
配置模型的方式:
openclaw config set model.provider deepseek
openclaw config set model.api_key sk-***
openclaw config set model.name deepseek-chat
如果需要 fallback,只在主模型失败时启用:
openclaw config set model.fallback.provider openai
openclaw config set model.fallback.name gpt-4o-mini
第三步:控制上下文长度
上下文是隐形的成本大户。每次对话越长,API 调用费用越高。
实用的控制方法:
- 让系统提示尽量精简
- 用
AGENTS.md和SOUL.md代替冗长的 system prompt - 开启提示缓存减少重复发送
- 对长对话做压缩
openclaw config set cache.enabled true
openclaw config set cache.ttl 3600
第四步:减少工具挂载
每挂载一个工具,模型每次调用都要收到完整的工具描述。10 个工具和 3 个工具的成本差距可能有 2-3 倍。
原则:
- 第一版只挂当前任务需要的工具
- 不同 Agent 分开配置工具集
- 定期清理不再使用的技能
openclaw skills list
看到不用的技能,及时移除。
第五步:观察真实使用量
设完限额和模型之后,观察一周真实使用量再做调整:
openclaw stats usage
openclaw stats cost
openclaw logs
重点看:
- 每天真实调用次数
- 哪些任务消耗最高
- fallback 触发频率
更值的成本控制顺序
成本控制优先级
1. 先设硬限额(dailyLimit + monthlyBudget)
2. 再选合适的模型档位
3. 再减上下文长度
4. 再减工具挂载数量
5. 再收 fallback 范围
6. 最后才调更细的参数
一个实际的低成本配置示例
openclaw config set model.provider deepseek
openclaw config set model.name deepseek-chat
openclaw config set model.fallback.provider openai
openclaw config set model.fallback.name gpt-4o-mini
openclaw config set ai.dailyLimit 500
openclaw config set ai.monthlyBudget 30
openclaw config set cache.enabled true
openclaw config set cache.ttl 3600
openclaw config set ai.maxConcurrentRequests 3
openclaw config set ai.timeout 30000
这套配置适合个人用户轻度使用,月成本通常在 30 美元以内。
继续阅读
- 模型成本控制
- 模型路由与 fallback
- 配置模板中心
- 安装后第一步
- 各平台用量查看 → OpenAI Usage · DeepSeek · 智谱
- 官方文档 → docs.openclaw.ai