实践openclaw-concepts
Personal agent benchmark pack · OpenClaw — 用10个本地场景测个人助手,防泄密防假进度,值得5分钟。
用10个本地场景测个人助手,防泄密防假进度,值得5分钟。
2026-08-10原文
本文为要点摘要,完整细节以原文为准。
- 10个YAML场景覆盖提醒、记忆、审批拒绝、失败恢复等,每个场景只测一个行为,用mock-openai保证确定性。
- 隐私模型严格隔离:只用假用户、假偏好、假密钥,不碰真实记忆或配置,红action检查用假标记,失败可安全排查。
- 扩展方式:新场景加YAML并声明语义ID,避免加新runner或依赖,直到场景足够稳定。
- 对harness设计:场景应小、本地、确定性,且用证明支撑的完成声明,防止假进度。