PRACTICE LIBRARY

本版运行记录 · 2026-10-01

随书配套 · 教学资料下载原文件 ↓

实际执行了什么

使用已安装的 CodeBuddy CLI 2.158.0,只开放 Read 工具,MCP 配置为空。采用客户端现有默认模型配置;导出的结果未给出可独立确认的模型标识,故不猜测具体模型。每批为新任务,显式读取随书 SKILL.md、字段规则和模板,再读指定虚构输入。四批返回 success,无工具权限拒绝。

CLI 只在最终回答交付正文,没有写业务文件;编辑过程将最终回答保存为以下 Markdown。原始日志包含工具路径等内部元数据,不在公开包中。公开执行清单只保留相对文件路径、状态与内部原始记录的校验值;不含账号、会话标识或内部推理。

批次 输入与结果 人工复核
第一次运行 三份 R001 需求;模型读到六个指定文件 关键地区/语言/未知保留;初稿存在过度限制、职责与门槛混用等问题,不能定稿
迁移与边界 R003、缺项、R004 冲突分别处理 第二岗位未串条件,双冲突保留;缺项题把 SaaS 误判为偏好,无编号被过度阻断
针对初稿修复 R001 原材料与初稿 找出多项错误并重写;其中仍有“待确认”等同“偏好”等表达问题,修复不等于免检
规则修订后回归 四类输入重新只读核对 OR/AND、SaaS 等级、编号缺失可做草稿、冲突不裁决、第二岗位不污染等关键检查通过;仍有下述人工修订项

宽表格可左右滑动查看

最后一次回归仍要人工改哪里

R001 的原始“职责概述:签约和后续激活”与“经验门槛:签约或激活”应分栏解释,不能简单写成同一条件从 AND 改成 OR 的已解决变更。回归表理解了经验门槛的 OR,但变更栏仍将两种用途混写。其下一步又建议确认未来管理范围,对当前不带人的本轮门槛不是优先问题,应后置。缺项题最后一问打包过多事项,可拆分后重新排序。

这说明技能能改善重复规则,但模型输出仍需人工核对。本书不把回归 success 状态称为“所有业务结论完全正确”。人工核对基准见进阶核对,正常基线见需求基线。

技能怎样迭代

初版三份文件经过首次、迁移和修复检查后,增加了:职责/门槛分开、条件等级不明保留待确认、联系人来源不冒充负责人确认、无编号可出草稿、限制不能伪造、澄清最多五题等规则。随书 ZIP/.skill 为修订后的内容,已做四类输入回归;前三份运行产物属于修订前方法验证,不能用来描述当前文件逐字行为。

没有声称验证的部分

全部业务输入均为合成教学数据。公开模型文件只摘取最终回答、去除原始元数据;保留错误用于教学,没有把修订答案冒充原始输出。