Free Preview
先试读:OpenClaw 选模型:先测任务,再定主模型和备用模型
模型更新和套餐调整远快于教程更新。OpenClaw 需要的不是一张“本月最强模型表”,而是一套能重复运行的任务评测、主模型选择和故障恢复方法。
这篇会帮你解决什么
- 删掉固定版本和价格推荐。
- 按任务质量、工具调用、稳定性、安全和总成本评测。
- 正确配置并验收主模型与 fallback。
可以先照着试的一句话
我要为 OpenClaw 的 ___ 任务选模型。请设计一个不含真实数据的评测集,覆盖工具调用、失败恢复、输出格式、安全边界和总成本;先不要修改现有配置。
完整文章会继续展开选择方法、真实工作流、验收标准和风险边界。
模型版本和套餐变化太快,固定推荐表会先过期
旧文案把 KIMI、MiniMax、GLM 的具体版本、价格和套餐写成长期结论。更可靠的方法,是先从 OpenClaw 当前可用的 provider/model 列表中筛选,再用自己的任务做小样。
模型名称、上下文、价格和套餐只在使用当天查看官方页面;文章负责教你怎样判断,不负责把一张阶段性价格表当永久答案。
工具型 Agent 选模型,要比聊天多测三件事
| 维度 | 测试方法 | 失败表现 |
|---|---|---|
| 任务质量 | 用固定任务与验收标准比较结果 | 表达好但漏关键要求 |
| 工具调用 | 测试读文件、调用工具和多步返回 | 参数错误、重复调用、不会恢复 |
| 稳定性 | 同一任务重复多次并观察高峰期 | 超时、空回复、格式漂移 |
| 安全性 | 加入不可信网页与权限边界测试 | 轻信页面指令或越权 |
| 总成本 | 记录输入输出、重试和返工 | 单价低但重试很多 |
先看当前状态,再修改默认模型
openclaw models status
openclaw models liststatus 用来确认当前主模型、备用链与认证状态;list 默认查看已配置或有认证条件的模型。列表中出现模型,不等于已经通过真实调用测试。
主模型负责常态质量,备用模型负责可解释的恢复
openclaw models set provider/model
openclaw models fallbacks add other-provider/backup-model
openclaw models fallbacks listOpenClaw 会先在同一 provider 内处理认证配置,再按配置进入模型 fallback。显式由用户在会话中选择的模型可能按严格模式失败,不应假设所有情况都会静默切换。
备用模型必须单独通过工具调用与格式测试。只因为它“便宜”或“快”就放进 fallback,可能在主模型失败时给出不同格式或更弱的安全判断。
用日报任务做一轮可重复评测
准备同一组模拟消息,让候选模型提取事项、负责人、日期和风险,并调用一次无副作用的测试工具。连续运行五次,记录字段遗漏、工具错误、耗时、重试和总用量。
主模型选择综合得分最高且稳定的;备用模型不追求完全相同,但必须保证关键字段、工具格式和安全边界一致。评测材料与评分表保留,模型升级后再跑一次。
不要用虚构账单判断成本,要记录自己的真实用量
- 把日常轻任务和复杂 Agent 任务分开统计。
- 把失败重试、上下文膨胀和人工返工算进总成本。
- 设置 provider 预算或提醒,定期查看 OpenClaw 状态与供应商账单。
- 价格变化时重新核对官方页面,不沿用文章中的旧数字。
- 先测任务,再设默认。
- fallback 也要验收,不能只是名单。
- 模型选择、认证和 Agent 权限是三件事,分别管理。
本文依据官方资料核验于 2026-07-13。具体入口、套餐、地区可用性和功能名称仍可能继续变化,使用时以产品内实际显示为准。