Files
Jyotisha/docs/testing/consult-single-pass-answer-20260927.md
T

71 lines
3.5 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 真机清单 · 普通咨询回答改由看过星盘的那一步写(BUG-1053)· 2026-09-27
部署含 `codex/consult-single-pass-answer-20260927` 的 staging 后照做。先确认 `https://staging.jyotisha.chat/api/health` 的 `deployment.gitCommit` 是这次部署的提交。
## 这次改了什么(给自己看的一句话)
以前本命提问算完盘后,看过星盘的那一步写的回答被丢掉,你看到的是另一个没看过星盘的步骤重写的,所以回答里的上升、月亮、宫位可能和星盘页对不上,或者直接说「没有盘面证据」。现在算完盘的那一步直接写给你。
## 准备
- 一个已校验星盘的账号(出生时间已确认的那种)。
- 另开一个标签页打开这个人的「星盘」页,停在本命盘,记下:上升星座、月亮星座与所在宫、太阳星座与所在宫。下面每一轮回答都拿来对照。
## 1. 默认模型:回答里的盘面事实对得上
1. 普通对话,默认模型,问:「我和父母的关系怎么样?」
2. 等它写完。
预期:
- 开头是几句没有标题的口语回答,然后是四个标题:先回答你的问题 / 盘里支持这个判断的地方 / 时间怎么看 / 这周可以做的一件事。
- 「盘里支持这个判断的地方」里提到的上升、月亮、宫位,和星盘页记下的一致。**只要有一处对不上,截图正文和星盘页一起发给我。**
- 正文开头**没有**「我先排一下盘」「我来调用工具」这类过程说明。
- 不再说「没有父母主题的盘面证据」这类话。
## 2. gpt-5.6-luna:同一个问题再问一次
1. 模型切到 gpt-5.6-luna,新开一个对话,问同一句「我和父母的关系怎么样?」。
预期:同第 1 条。以前这个模型会直接说没有盘面证据;现在应当引用和星盘页一致的事实。
## 3. 换个领域再对一次
1. 默认模型,问:「我明年的事业和财运怎么样?」
预期:同第 1 条;另外「时间怎么看」里提到的大运 / 年份,和星盘页「大运」栏大致对得上(不要求逐日)。
## 4. 等待时间
对第 1–3 条各记一次:从点发送到最后一个字出来,大约多少秒。
预期:
- 一般比以前快(少了一次重写);最慢不超过约 3 分钟。
- 活动区一直有进度:读取方法 → 计算本命盘 → 思考行 → 正在组织回答。
- 第一段字出现前会有一两秒停顿(要等写出第一个小标题或约 160 字才一起出来),之后是连续出字,这是预期,不是卡住。
## 5. 首页「深入看今日」
1. 首页点「深入看今日」。
预期:正文是三节(「今日趋势」「适合推进 / 需要避开」「一个行动」),**不是**本命的四个标题;最后一节有技法审计表和「探索性日提示,不是确定预测」。
## 6. 没写完的回答(平时留意即可)
这一条很难故意制造。遇到时对照:
- 正文停在最后一个完整的句子上。
- 输入框上方出现「回答未完成,已保留现有内容;本次不会扣点。」
- 点数不变;刷新后那段没写完的回答还在。
## 7. 后台核对(管理员账号,可选)
1. `/admin/consultations` 找到第 1–3 条:状态 `completed`。
2. `/admin/usage` 同一时间的那几行:耗时不超过约 `180000 ms`。
## 发现问题时发我什么
- 对不上的那一轮:正文截图 + 星盘页截图 + 用的哪个模型 + 大概时间。
- 等了很久的那一轮:秒数 + 模型 + 大概时间。