Free Preview

先试读:OpenClaw 选模型:先测任务,再定主模型和备用模型

模型更新和套餐调整远快于教程更新。OpenClaw 需要的不是一张“本月最强模型表”,而是一套能重复运行的任务评测、主模型选择和故障恢复方法。

这篇会帮你解决什么

  • 删掉固定版本和价格推荐。
  • 按任务质量、工具调用、稳定性、安全和总成本评测。
  • 正确配置并验收主模型与 fallback。

可以先照着试的一句话

我要为 OpenClaw 的 ___ 任务选模型。请设计一个不含真实数据的评测集,覆盖工具调用、失败恢复、输出格式、安全边界和总成本;先不要修改现有配置。

完整文章会继续展开选择方法、真实工作流、验收标准和风险边界。

01 · 先删掉固定榜单

模型版本和套餐变化太快,固定推荐表会先过期

旧文案把 KIMI、MiniMax、GLM 的具体版本、价格和套餐写成长期结论。更可靠的方法,是先从 OpenClaw 当前可用的 provider/model 列表中筛选,再用自己的任务做小样。

模型名称、上下文、价格和套餐只在使用当天查看官方页面;文章负责教你怎样判断,不负责把一张阶段性价格表当永久答案。

02 · 五项测试

工具型 Agent 选模型,要比聊天多测三件事

维度测试方法失败表现
任务质量用固定任务与验收标准比较结果表达好但漏关键要求
工具调用测试读文件、调用工具和多步返回参数错误、重复调用、不会恢复
稳定性同一任务重复多次并观察高峰期超时、空回复、格式漂移
安全性加入不可信网页与权限边界测试轻信页面指令或越权
总成本记录输入输出、重试和返工单价低但重试很多
03 · 只读检查

先看当前状态,再修改默认模型

先执行只读命令
openclaw models status openclaw models list

status 用来确认当前主模型、备用链与认证状态;list 默认查看已配置或有认证条件的模型。列表中出现模型,不等于已经通过真实调用测试。

不要在教程中粘贴 API Key。认证使用官方 onboarding 或 auth 流程;文章只记录 provider 名称和验收结果,不保存凭证。
04 · 主模型与 fallback

主模型负责常态质量,备用模型负责可解释的恢复

示意命令 · 用你已验证的 provider/model 替换
openclaw models set provider/model openclaw models fallbacks add other-provider/backup-model openclaw models fallbacks list

OpenClaw 会先在同一 provider 内处理认证配置,再按配置进入模型 fallback。显式由用户在会话中选择的模型可能按严格模式失败,不应假设所有情况都会静默切换。

备用模型必须单独通过工具调用与格式测试。只因为它“便宜”或“快”就放进 fallback,可能在主模型失败时给出不同格式或更弱的安全判断。

05 · 示例

用日报任务做一轮可重复评测

准备同一组模拟消息,让候选模型提取事项、负责人、日期和风险,并调用一次无副作用的测试工具。连续运行五次,记录字段遗漏、工具错误、耗时、重试和总用量。

主模型选择综合得分最高且稳定的;备用模型不追求完全相同,但必须保证关键字段、工具格式和安全边界一致。评测材料与评分表保留,模型升级后再跑一次。

06 · 预算

不要用虚构账单判断成本,要记录自己的真实用量

  • 把日常轻任务和复杂 Agent 任务分开统计。
  • 把失败重试、上下文膨胀和人工返工算进总成本。
  • 设置 provider 预算或提醒,定期查看 OpenClaw 状态与供应商账单。
  • 价格变化时重新核对官方页面,不沿用文章中的旧数字。
最终配置原则
  • 先测任务,再设默认。
  • fallback 也要验收,不能只是名单。
  • 模型选择、认证和 Agent 权限是三件事,分别管理。
官方资料与核验日期

本文依据官方资料核验于 2026-07-13。具体入口、套餐、地区可用性和功能名称仍可能继续变化,使用时以产品内实际显示为准。

Next Step

学完这篇,下一步这样走

先把刚学的内容用起来,再继续读两篇相关内容;如果想换主题,可以回到本系列目录重新选择。

现在就练一下

给三类任务各选一个默认模型和备用模型:短回复、长文整理、代码/工具任务,并写下选择原因和预算上限。