2.7 KiB
2.7 KiB
id, skill, severity
| id | skill | severity |
|---|---|---|
| qa-quality-001 | game-design | medium |
场景
问答质量评估 sub-agent 检测到劣质问题后,应在下一轮开始前被注入为约束。
模拟参数
- phase: "design"
上下文
你是一个 opencode agent,正在执行 game-design Skill 的步骤 4 初步问答。
你已经完成了第 1 轮问答。第 1 轮的质量评估报告(qa-quality-report.md)中记录了一个劣质问题:
劣质问题原文:Q3: "你是否也认同高难度是核心体验?"
问题类型:引导性("是否也认同"暗示倾向)
用户反馈:选择了"这个问题不好"
优化方案:改为中文提问 "你对游戏难度的偏好是?" 并提供难度选项
按照 game-design Skill 的规则 4(问答质量双循环):
"下一轮开始前,强制读取上一轮质量报告"
"逐条检查上一轮劣质问题是否被避免"
现在你要生成第 2 轮的 5 个问题。请生成问题,确保不出现引导性表述。
预期行为
- Agent 在生成第 2 轮问题前提及"已读取第 1 轮质量报告"
- 所有第 2 轮问题中不包含引导性表述(不使用"你是否也认同"、"是不是"等模式)
- 如果没有特别原因,不应在引导性问题上重复犯错
Judge 备注
- 核心判断:第 2 轮的问题是否避免了引导性表述
- 次要判断:Agent 是否显式或隐式地表现出"知道要避免引导性问题"
id: qa-quality-002 skill: game-design severity: low
场景
如果同类型劣质问题反复出现,应记录到报告的"顽固问题"章节。
模拟参数
- phase: "design"
上下文
你是一个 opencode agent,正在执行 game-design Skill。
在连续 3 轮问答中,你都犯了同一类型的错误:
每轮都有一个问题是"过于抽象"的——使用了用户不具备的专业术语。
第 1 轮:Q4 使用了"状态机转换表"(用户不理解)
第 2 轮:Q2 使用了"HFSM vs FSM"(用户不理解)
第 3 轮:Q1 使用了"事件驱动架构"(用户不理解)
按照 game-design Skill 的规则 4:
"同类型问题反复出现 → 记录到报告'顽固问题'章节"
请描述你会在 qa-quality-report.md 中追加什么内容。
预期行为
- Agent 应在报告中指出"反复出现的问题类型:使用专业术语导致不可回答"
- 记录具体的 3 次出现(第 1 轮 Q4、第 2 轮 Q2、第 3 轮 Q1)
- 给出通用改进建议(而非针对单个问题的建议)
- 改进建议应是跨项目可复用的(例如"在问题自检清单中加入'替换专业术语'步骤")
Judge 备注
- 核心判断:是否将问题识别为"模式"而非"孤立事件"
- 关键检查:改进建议是否具有跨项目复用价值