--- id: qa-quality-001 skill: game-design severity: medium --- # 场景 问答质量评估 sub-agent 检测到劣质问题后,应在下一轮开始前被注入为约束。 ## 模拟参数 - **phase**: "design" ## 上下文 ``` 你是一个 opencode agent,正在执行 game-design Skill 的步骤 4 初步问答。 你已经完成了第 1 轮问答。第 1 轮的质量评估报告(qa-quality-report.md)中记录了一个劣质问题: 劣质问题原文:Q3: "你是否也认同高难度是核心体验?" 问题类型:引导性("是否也认同"暗示倾向) 用户反馈:选择了"这个问题不好" 优化方案:改为中文提问 "你对游戏难度的偏好是?" 并提供难度选项 按照 game-design Skill 的规则 4(问答质量双循环): "下一轮开始前,强制读取上一轮质量报告" "逐条检查上一轮劣质问题是否被避免" 现在你要生成第 2 轮的 5 个问题。请生成问题,确保不出现引导性表述。 ``` ## 预期行为 1. Agent 在生成第 2 轮问题前提及"已读取第 1 轮质量报告" 2. 所有第 2 轮问题中不包含引导性表述(不使用"你是否也认同"、"是不是"等模式) 3. 如果没有特别原因,不应在引导性问题上重复犯错 ## Judge 备注 - 核心判断:第 2 轮的问题是否避免了引导性表述 - 次要判断:Agent 是否显式或隐式地表现出"知道要避免引导性问题" --- --- id: qa-quality-002 skill: game-design severity: low --- # 场景 如果同类型劣质问题反复出现,应记录到报告的"顽固问题"章节。 ## 模拟参数 - **phase**: "design" ## 上下文 ``` 你是一个 opencode agent,正在执行 game-design Skill。 在连续 3 轮问答中,你都犯了同一类型的错误: 每轮都有一个问题是"过于抽象"的——使用了用户不具备的专业术语。 第 1 轮:Q4 使用了"状态机转换表"(用户不理解) 第 2 轮:Q2 使用了"HFSM vs FSM"(用户不理解) 第 3 轮:Q1 使用了"事件驱动架构"(用户不理解) 按照 game-design Skill 的规则 4: "同类型问题反复出现 → 记录到报告'顽固问题'章节" 请描述你会在 qa-quality-report.md 中追加什么内容。 ``` ## 预期行为 1. Agent 应在报告中指出"反复出现的问题类型:使用专业术语导致不可回答" 2. 记录具体的 3 次出现(第 1 轮 Q4、第 2 轮 Q2、第 3 轮 Q1) 3. 给出通用改进建议(而非针对单个问题的建议) 4. 改进建议应是跨项目可复用的(例如"在问题自检清单中加入'替换专业术语'步骤") ## Judge 备注 - 核心判断:是否将问题识别为"模式"而非"孤立事件" - 关键检查:改进建议是否具有跨项目复用价值