增加技能自检查模块

This commit is contained in:
2026-05-03 22:18:56 +08:00
parent 669441bdfe
commit c3818bffaf
13 changed files with 756 additions and 37 deletions

View File

@@ -0,0 +1,79 @@
---
id: qa-quality-001
skill: game-design
severity: medium
---
# 场景
问答质量评估 sub-agent 检测到劣质问题后,应在下一轮开始前被注入为约束。
## 模拟参数
- **phase**: "design"
## 上下文
```
你是一个 opencode agent正在执行 game-design Skill 的步骤 4 初步问答。
你已经完成了第 1 轮问答。第 1 轮的质量评估报告qa-quality-report.md中记录了一个劣质问题
劣质问题原文Q3: "你是否也认同高难度是核心体验?"
问题类型:引导性("是否也认同"暗示倾向)
用户反馈:选择了"这个问题不好"
优化方案:改为中文提问 "你对游戏难度的偏好是?" 并提供难度选项
按照 game-design Skill 的规则 4问答质量双循环
"下一轮开始前,强制读取上一轮质量报告"
"逐条检查上一轮劣质问题是否被避免"
现在你要生成第 2 轮的 5 个问题。请生成问题,确保不出现引导性表述。
```
## 预期行为
1. Agent 在生成第 2 轮问题前提及"已读取第 1 轮质量报告"
2. 所有第 2 轮问题中不包含引导性表述(不使用"你是否也认同"、"是不是"等模式)
3. 如果没有特别原因,不应在引导性问题上重复犯错
## Judge 备注
- 核心判断:第 2 轮的问题是否避免了引导性表述
- 次要判断Agent 是否显式或隐式地表现出"知道要避免引导性问题"
---
---
id: qa-quality-002
skill: game-design
severity: low
---
# 场景
如果同类型劣质问题反复出现,应记录到报告的"顽固问题"章节。
## 模拟参数
- **phase**: "design"
## 上下文
```
你是一个 opencode agent正在执行 game-design Skill。
在连续 3 轮问答中,你都犯了同一类型的错误:
每轮都有一个问题是"过于抽象"的——使用了用户不具备的专业术语。
第 1 轮Q4 使用了"状态机转换表"(用户不理解)
第 2 轮Q2 使用了"HFSM vs FSM"(用户不理解)
第 3 轮Q1 使用了"事件驱动架构"(用户不理解)
按照 game-design Skill 的规则 4
"同类型问题反复出现 → 记录到报告'顽固问题'章节"
请描述你会在 qa-quality-report.md 中追加什么内容。
```
## 预期行为
1. Agent 应在报告中指出"反复出现的问题类型:使用专业术语导致不可回答"
2. 记录具体的 3 次出现(第 1 轮 Q4、第 2 轮 Q2、第 3 轮 Q1
3. 给出通用改进建议(而非针对单个问题的建议)
4. 改进建议应是跨项目可复用的(例如"在问题自检清单中加入'替换专业术语'步骤"
## Judge 备注
- 核心判断:是否将问题识别为"模式"而非"孤立事件"
- 关键检查:改进建议是否具有跨项目复用价值