Files
Jyotisha/docs/testing/consult-single-pass-answer-20260927.md
T

3.5 KiB
Raw Blame History

真机清单 · 普通咨询回答改由看过星盘的那一步写(BUG-1053)· 2026-09-27

部署含 codex/consult-single-pass-answer-20260927 的 staging 后照做。先确认 https://staging.jyotisha.chat/api/health 的 deployment.gitCommit 是这次部署的提交。

这次改了什么(给自己看的一句话)

以前本命提问算完盘后,看过星盘的那一步写的回答被丢掉,你看到的是另一个没看过星盘的步骤重写的,所以回答里的上升、月亮、宫位可能和星盘页对不上,或者直接说「没有盘面证据」。现在算完盘的那一步直接写给你。

准备

  • 一个已校验星盘的账号(出生时间已确认的那种)。
  • 另开一个标签页打开这个人的「星盘」页,停在本命盘,记下:上升星座、月亮星座与所在宫、太阳星座与所在宫。下面每一轮回答都拿来对照。

1. 默认模型:回答里的盘面事实对得上

  1. 普通对话,默认模型,问:「我和父母的关系怎么样?」
  2. 等它写完。

预期:

  • 开头是几句没有标题的口语回答,然后是四个标题:先回答你的问题 / 盘里支持这个判断的地方 / 时间怎么看 / 这周可以做的一件事。
  • 「盘里支持这个判断的地方」里提到的上升、月亮、宫位,和星盘页记下的一致。只要有一处对不上,截图正文和星盘页一起发给我。
  • 正文开头没有「我先排一下盘」「我来调用工具」这类过程说明。
  • 不再说「没有父母主题的盘面证据」这类话。

2. gpt-5.6-luna:同一个问题再问一次

  1. 模型切到 gpt-5.6-luna,新开一个对话,问同一句「我和父母的关系怎么样?」。

预期:同第 1 条。以前这个模型会直接说没有盘面证据;现在应当引用和星盘页一致的事实。

3. 换个领域再对一次

  1. 默认模型,问:「我明年的事业和财运怎么样?」

预期:同第 1 条;另外「时间怎么看」里提到的大运 / 年份,和星盘页「大运」栏大致对得上(不要求逐日)。

4. 等待时间

对第 1–3 条各记一次:从点发送到最后一个字出来,大约多少秒。

预期:

  • 一般比以前快(少了一次重写);最慢不超过约 3 分钟。
  • 活动区一直有进度:读取方法 → 计算本命盘 → 思考行 → 正在组织回答。
  • 第一段字出现前会有一两秒停顿(要等写出第一个小标题或约 160 字才一起出来),之后是连续出字,这是预期,不是卡住。

5. 首页「深入看今日」

  1. 首页点「深入看今日」。

预期:正文是三节(「今日趋势」「适合推进 / 需要避开」「一个行动」),不是本命的四个标题;最后一节有技法审计表和「探索性日提示,不是确定预测」。

6. 没写完的回答(平时留意即可)

这一条很难故意制造。遇到时对照:

  • 正文停在最后一个完整的句子上。
  • 输入框上方出现「回答未完成,已保留现有内容;本次不会扣点。」
  • 点数不变;刷新后那段没写完的回答还在。

7. 后台核对(管理员账号,可选)

  1. /admin/consultations 找到第 1–3 条:状态 completed。
  2. /admin/usage 同一时间的那几行:耗时不超过约 180000 ms。

发现问题时发我什么

  • 对不上的那一轮:正文截图 + 星盘页截图 + 用的哪个模型 + 大概时间。
  • 等了很久的那一轮:秒数 + 模型 + 大概时间。