814c924e4a
Keep askable cards after exhaustion, explain each probe, read the adopted credible range in reports and chat, and compare declared periods before the minute grid when the clock is unknown. Co-authored-by: Cursor <cursoragent@cursor.com>
1.7 KiB
1.7 KiB
Staging 人肉复核 · 过程解释层(2026-09-06)
给产品负责人。不要把真实案例里的年份、事件或候选分钟写进任何记录。
对应 TASK-rectification-explain-layer-20260906.md。测之前先做第 0 条。
0. 确认测的是新版本
浏览器打开 https://staging.jyotisha.chat/api/health,看 deployment.gitCommit 前 8 位是否等于本单合入 staging 后的提交。不一致 = 先别测。
1. 每张选择题能展开「为什么问这题」
走到会出现 A/B/C/D 卡的那一轮。
- ✅ 预期:题干下方有可点开的「为什么问这题」。展开后能看到年月或 D9/D10,以及「分成两组」或「类型差异」。没有「概率 / 置信度 / 确定」。
- ❌ 失败:没有折叠说明;或说明仍是给模型看的「时间范围锁定…语义目标是…」。
2. 答完一题能看见哪段升降和范围变化
点 A 或 B。
- ✅ 预期:助手旁白仍以「已记录你的选择」开头,并写哪段领先/落后;范围变了就写「范围从 … 收到 …」,没变就写「范围没变」。点 D 仍是「这题先不计分,换一件事问」。
- ❌ 失败:仍只有「并更新了候选比较」;或范围没变却写成收窄。
3. 每轮顶部有第 N 步 / 原因 / 下一步
看输入框上方。口述采集时,步骤句在「先这样,先看当前范围」按钮左侧同一区域。
- ✅ 预期:始终能看到「第 N 步」和一句下一步。采集阶段是第 1 步,选择题阶段是第 2 步,问完给结果是第 3 步,采用后是第 4 步。
- ❌ 失败:没有步骤条;或步骤条出现「概率 / 置信度 / 确定」。