实际执行了什么
使用已安装的 CodeBuddy CLI 2.158.0,只开放 Read 工具,MCP 配置为空。采用客户端现有默认模型配置;导出的结果未给出可独立确认的模型标识,故不猜测具体模型。每批为新任务,显式读取随书 SKILL.md、字段规则和模板,再读指定虚构输入。四批返回 success,无工具权限拒绝。
CLI 只在最终回答交付正文,没有写业务文件;编辑过程将最终回答保存为以下 Markdown。原始日志包含工具路径等内部元数据,不在公开包中。公开执行清单只保留相对文件路径、状态与内部原始记录的校验值;不含账号、会话标识或内部推理。
| 批次 | 输入与结果 | 人工复核 |
|---|---|---|
| 第一次运行 | 三份 R001 需求;模型读到六个指定文件 | 关键地区/语言/未知保留;初稿存在过度限制、职责与门槛混用等问题,不能定稿 |
| 迁移与边界 | R003、缺项、R004 冲突分别处理 | 第二岗位未串条件,双冲突保留;缺项题把 SaaS 误判为偏好,无编号被过度阻断 |
| 针对初稿修复 | R001 原材料与初稿 | 找出多项错误并重写;其中仍有“待确认”等同“偏好”等表达问题,修复不等于免检 |
| 规则修订后回归 | 四类输入重新只读核对 | OR/AND、SaaS 等级、编号缺失可做草稿、冲突不裁决、第二岗位不污染等关键检查通过;仍有下述人工修订项 |
宽表格可左右滑动查看
最后一次回归仍要人工改哪里
R001 的原始“职责概述:签约和后续激活”与“经验门槛:签约或激活”应分栏解释,不能简单写成同一条件从 AND 改成 OR 的已解决变更。回归表理解了经验门槛的 OR,但变更栏仍将两种用途混写。其下一步又建议确认未来管理范围,对当前不带人的本轮门槛不是优先问题,应后置。缺项题最后一问打包过多事项,可拆分后重新排序。
这说明技能能改善重复规则,但模型输出仍需人工核对。本书不把回归 success 状态称为“所有业务结论完全正确”。人工核对基准见进阶核对,正常基线见需求基线。
技能怎样迭代
初版三份文件经过首次、迁移和修复检查后,增加了:职责/门槛分开、条件等级不明保留待确认、联系人来源不冒充负责人确认、无编号可出草稿、限制不能伪造、澄清最多五题等规则。随书 ZIP/.skill 为修订后的内容,已做四类输入回归;前三份运行产物属于修订前方法验证,不能用来描述当前文件逐字行为。
没有声称验证的部分
- WorkBuddy 桌面版 5.6.2 核对了可见界面标识;导入路径参考当前官方文档。没有完成该 ZIP 在 WorkBuddy 桌面端的导入、自动发现与调用测试。 CodeBuddy CLI 显式读文件不证明桌面已安装技能。
- 没有授权或实测外部连接器,没有创建真实周期任务,没有自动操作招聘平台或发送沟通。
- 公司研究、Mapping、候选人与四表扩展提供虚构输入及编辑参考,不能标成真实联网寻访实测或客户成功案例。
- 没有目标读者独立试读数据,也没有已验证的节省时间、成交或客户增长。
全部业务输入均为合成教学数据。公开模型文件只摘取最终回答、去除原始元数据;保留错误用于教学,没有把修订答案冒充原始输出。