research: score Jev intent variants with the previous turn
The earlier report had no previous-turn rows. This run measures V0, V1, V2, and Flash on the re-extracted corpus and records that the real sample is not representative of the simulated set. Co-authored-by: Cursor <cursoragent@cursor.com>
This commit is contained in:
+337919
-99456
File diff suppressed because it is too large
Load Diff
@@ -1,52 +1,102 @@
|
||||
# TypeSafe Jev 意图分类 · 上一轮 state 对照(2026-09-27)
|
||||
|
||||
- 任务:`docs/tasks/TASK-rectification-jev-intent-classifier-research-v2-20260927.md`
|
||||
- 基线:`origin/staging` @ `710c848b`
|
||||
- 模型:`jev-1.13.0`;SDK `typesafe-sdk 0.7.0`
|
||||
- 结论:**缺数据**。上一轮变量没有测全,不能判过门。已有的 V0 数字只作对照,不代替 V1/V2。
|
||||
|
||||
## 样本
|
||||
|
||||
- 来源 B:157 条。有上一轮 0,无上一轮 157。
|
||||
- 层:点选 17 / 采集 107 / 无焦点 33。
|
||||
- gold 来源:{"legacy_file": 157}。
|
||||
- 链式与 gold 上界都未跑。09-19 文件没有 turn_id / case_id,本机没有 staging 库。
|
||||
|
||||
## 来源 B
|
||||
|
||||
| 变体 | n | intent | answer_class | dated | 高置信错误 | 低置信召回 | 无焦点 unclear→answer |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: | ---: | --- |
|
||||
| Jev V0(09-19 缓存) | 157 | 91.1% | 98.0% | 91.7% | 6.4% | 24.1% | 7 / 无焦点高置信错误 12.1% |
|
||||
| Flash V0(09-19 缓存,生产提示) | 157 | 89.2% | 97.0% | 93.6% | — | — | 5 / 无焦点高置信错误 — |
|
||||
| Jev V1 | — | — | — | — | — | — | — |
|
||||
| Jev V2 链式 | — | — | — | — | — | — | — |
|
||||
| Jev V2 gold 上界 | — | — | — | — | — | — | — |
|
||||
| Flash + V1 | — | — | — | — | — | — | — |
|
||||
|
||||
Jev V0 自洽率:96.2%。
|
||||
|
||||
## 来源 C 回归锚(只 V0)
|
||||
|
||||
- choice:重算 99.0%,09-19 公布 99.0%,差 0.0 pp(n=400)。
|
||||
- collect:重算 92.2%,09-19 公布 92.2%,差 0.05 pp(n=400)。
|
||||
- none:重算 96.0%,09-19 公布 96.0%,差 0.0 pp(n=100)。
|
||||
- 来源 C 自洽率:99.0%。
|
||||
|
||||
## 无焦点层混淆(来源 B,V0)
|
||||
|
||||
计数来自报告 JSON,不含原文。
|
||||
|
||||
| gold \ pred | provide_new_evidence | stop_rectification | ask_about_result | unclear | answer_current_focus |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: |
|
||||
| provide_new_evidence | 24 | 0 | 0 | 0 | 0 |
|
||||
| stop_rectification | 0 | 0 | 0 | 0 | 0 |
|
||||
| ask_about_result | 0 | 0 | 1 | 0 | 0 |
|
||||
| unclear | 0 | 0 | 0 | 1 | 7 |
|
||||
| answer_current_focus | 0 | 0 | 0 | 0 | 0 |
|
||||
|
||||
## 写不出的项
|
||||
|
||||
n_有上一轮 0 < 100;V1 没有预测;V2 链式没有预测;V2 gold 上界没有预测;Flash+V1 没有预测;来源 B 与来源 C 同层 intent 差 > 10pp
|
||||
|
||||
V1、V2、Flash+V1 要等 staging 库抽出带 `case_id` 的上一轮,并且本机有 `DEEPSEEK_API_KEY` 之后才能补。门槛不放宽。
|
||||
|
||||
# TypeSafe Jev 意图分类 · 上一轮 state 对照(2026-09-27)
|
||||
|
||||
- 任务:`docs/tasks/TASK-rectification-jev-intent-classifier-research-v2-20260927.md`
|
||||
- 基线:`origin/staging` @ `fdb7087b`(任务书提交 `710c848b` 在其历史上)
|
||||
- 模型:`jev-1.13.0`;SDK `typesafe-sdk 0.7.0`
|
||||
- 结论:**缺数据**。来源 B 与来源 C 同层 intent 差超过 10pp(点选 23.7 pp,无焦点 38.8 pp)。按任务书这一项写缺数据,不把这批真人样本外推成过门。只看这批来源 B,高置信错误 8.0% > 3%;低置信召回 27.2% < 60%。
|
||||
|
||||
## 样本
|
||||
|
||||
- 来源 B:715 条。有上一轮 634,无上一轮 81。
|
||||
- 层:点选 269 / 采集 336 / 无焦点 110。
|
||||
- gold 来源:{"executor_read": 565, "option_echo": 150}。
|
||||
- 09-19 的 source_b.jsonl 不在本机,旧 157 条按 turn_id 对回 0 条。其余 gold 为执行方按生产标注规范阅读后写入;点选回显另计。
|
||||
- V2 链式的 previous_decision 来自同案上一条 Jev V2 输出(链式,自喂)。V2 gold 上界来自同案上一条人工 gold。案件第一轮 previous_turn 为 null,不喂 previous_decision。
|
||||
|
||||
## 来源 B
|
||||
|
||||
| 变体 | n | intent | answer_class | dated | 高置信错误 | 低置信召回 | 无焦点 unclear→answer |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: | ---: | --- |
|
||||
| Jev V0 | 715 | 79.4% | 98.9% | 95.2% | 12.9% | 15.1% | 43 / 无焦点高置信错误 32.7% |
|
||||
| Flash V0(生产提示) | 715 | 75.7% | 99.3% | 97.8% | — | — | 42 / 无焦点高置信错误 — |
|
||||
| Jev V1 | 715 | 75.0% | 92.8% | 87.0% | 9.4% | 31.9% | 32 / 无焦点高置信错误 11.8% |
|
||||
| Jev V2 链式(自喂) | 715 | 75.9% | 96.6% | 88.7% | 8.0% | 27.2% | 33 / 无焦点高置信错误 16.4% |
|
||||
| Jev V2 gold 上界 | 715 | 75.7% | 96.6% | 89.0% | 7.7% | 28.8% | 34 / 无焦点高置信错误 13.6% |
|
||||
| Flash + V1 | 715 | 74.0% | 99.1% | 95.0% | — | — | 43 / 无焦点高置信错误 — |
|
||||
|
||||
自洽率:V0 98.9%;V1 94.3%;V2 链式 93.3%;V2 gold 93.8%。
|
||||
|
||||
有上一轮 / 无上一轮(intent;Jev 另给高置信错误):
|
||||
|
||||
| 变体 | 有上一轮 n | intent | 高置信错误 | 无上一轮 n | intent | 高置信错误 |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: | ---: |
|
||||
| Jev V0 | 634 | 77.0% | 14.0% | 81 | 98.8% | 3.7% |
|
||||
| Jev V1 | 634 | 71.9% | 10.3% | 81 | 98.8% | 2.5% |
|
||||
| Jev V2 链式 | 634 | 73.2% | 8.8% | 81 | 97.5% | 1.2% |
|
||||
| Jev V2 gold | 634 | 72.7% | 8.5% | 81 | 98.8% | 1.2% |
|
||||
| Flash V0 | 634 | 72.9% | — | 81 | 97.5% | — |
|
||||
| Flash + V1 | 634 | 71.1% | — | 81 | 96.3% | — |
|
||||
|
||||
延迟与输入 token(来源 B,第一次):
|
||||
|
||||
| 变体 | 中位 ms | P95 ms | 次均 input tok |
|
||||
| --- | ---: | ---: | ---: |
|
||||
| Jev V0 | 1178 | 1376 | 1028.0 |
|
||||
| Jev V1 | 1187 | 1358 | 1161.8 |
|
||||
| Jev V2 链式 | 1206 | 1362 | 1313.6 |
|
||||
| Jev V2 gold | 1207 | 1399 | 1313.0 |
|
||||
| Flash V0 | 705 | 989 | 492.7 |
|
||||
| Flash + V1 | 717 | 1016 | 552.8 |
|
||||
|
||||
无焦点层 intent:V0 58.2%,V2 链式 46.4%。高置信错误从 32.7% 到 16.4%。
|
||||
V2 链式承接分:中位 0.16,最大 0.86,≥ 0.9 的 0 条,实际沿用上一轮 intent 的 0 条。
|
||||
|
||||
去掉点选回显后,V2 链式 n=565,intent 69.6%,高置信错误 8.3%,低置信召回 28.5%。门槛仍按全量样本。
|
||||
|
||||
## 来源 C 回归锚(只 V0,跑一次)
|
||||
|
||||
- 点选:来源 C 98.8%,09-19 公布 99.0%,差 -0.25 pp(n=400)。来源 B 75.1%,与来源 C 差 23.7 pp(n=269)。
|
||||
- 采集:来源 C 92.5%,09-19 公布 92.2%,差 0.3 pp(n=400)。来源 B 89.9%,与来源 C 差 2.6 pp(n=336)。
|
||||
- 无焦点:来源 C 97.0%,09-19 公布 96.0%,差 1.0 pp(n=100)。来源 B 58.2%,与来源 C 差 38.8 pp(n=110)。
|
||||
- 来源 C 自洽率:—。
|
||||
|
||||
## 无焦点层混淆(来源 B)
|
||||
|
||||
计数来自报告 JSON,不含原文。
|
||||
|
||||
### V0
|
||||
|
||||
| gold \ pred | provide_new_evidence | stop_rectification | ask_about_result | unclear | answer_current_focus |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: |
|
||||
| provide_new_evidence | 60 | 0 | 0 | 0 | 0 |
|
||||
| stop_rectification | 0 | 0 | 0 | 0 | 0 |
|
||||
| ask_about_result | 0 | 0 | 2 | 2 | 0 |
|
||||
| unclear | 1 | 0 | 0 | 2 | 43 |
|
||||
| answer_current_focus | 0 | 0 | 0 | 0 | 0 |
|
||||
|
||||
### V1
|
||||
|
||||
| gold \ pred | provide_new_evidence | stop_rectification | ask_about_result | unclear | answer_current_focus |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: |
|
||||
| provide_new_evidence | 45 | 0 | 0 | 0 | 15 |
|
||||
| stop_rectification | 0 | 0 | 0 | 0 | 0 |
|
||||
| ask_about_result | 2 | 0 | 0 | 1 | 1 |
|
||||
| unclear | 11 | 0 | 0 | 3 | 32 |
|
||||
| answer_current_focus | 0 | 0 | 0 | 0 | 0 |
|
||||
|
||||
### V2 链式
|
||||
|
||||
| gold \ pred | provide_new_evidence | stop_rectification | ask_about_result | unclear | answer_current_focus |
|
||||
| --- | ---: | ---: | ---: | ---: | ---: |
|
||||
| provide_new_evidence | 47 | 0 | 0 | 0 | 13 |
|
||||
| stop_rectification | 0 | 0 | 0 | 0 | 0 |
|
||||
| ask_about_result | 1 | 0 | 1 | 1 | 1 |
|
||||
| unclear | 10 | 0 | 0 | 3 | 33 |
|
||||
| answer_current_focus | 0 | 0 | 0 | 0 | 0 |
|
||||
|
||||
## 写不出的项
|
||||
|
||||
来源 B 与来源 C 同层 intent 差 > 10pp
|
||||
|
||||
来源 B 的 Jev 八次合计 6887443 input tok,按 $0.042/M 约 $0.2893。来源 C 一次 939273 input tok,约 $0.0394。Flash 两次合计 747581 input tok,不按 Jev 单价计。响应 model:['jev-1.13.0']。
|
||||
|
||||
|
||||
@@ -1,45 +1,54 @@
|
||||
# 进度 · Jev 意图分类 v2:上一轮放进 state(2026-09-27)
|
||||
|
||||
- 分支:`codex/jev-intent-v2-20260927`
|
||||
- 基线:`origin/staging` @ `710c848b`
|
||||
- 基线:`origin/staging` @ `fdb7087b`(任务书提交 `710c848b` 在其历史上;本机 fetch 后 staging 尖端是 `fdb7087b`)
|
||||
- 任务书:`docs/tasks/TASK-rectification-jev-intent-classifier-research-v2-20260927.md`
|
||||
- 报告:`docs/research/jev_intent_2026_09_27.md` / `.json`
|
||||
- 结论:**缺数据**。有上一轮 0 条,V1/V2 没有数字,不能判过门。
|
||||
- 结论:**缺数据**。来源 B 与来源 C 同层 intent 差超过 10pp(点选 23.7 pp,无焦点 38.8 pp)。只看这批来源 B,V2 链式高置信错误 8.0% > 3%,低置信召回 27.2% < 60%,同样过不了门。
|
||||
|
||||
## 已跑到的数
|
||||
|
||||
| 项 | 结果 |
|
||||
| --- | --- |
|
||||
| 来源 B | 157(点选 17 / 采集 107 / 无焦点 33)。gold 全部来自 09-19 文件,不是新标 |
|
||||
| 有上一轮 / 无上一轮 | 0 / 157 |
|
||||
| Jev V0 intent | 91.1%(自洽 96.2%,高置信错误 6.4%,低置信召回 24.1%) |
|
||||
| Flash V0 intent | 89.2%(09-19 缓存,生产提示;Flash 没有置信度) |
|
||||
| 无焦点 `unclear → answer_current_focus` | Jev V0 = 7,Flash V0 = 5 |
|
||||
| 来源 C V0 相对 09-19 公布值 | 点选 0 pp,采集 +0.05 pp(公布值四舍五入到 92.2%),无焦点 0 pp |
|
||||
| 来源 B | 715(点选 269 / 采集 336 / 无焦点 110)。有上一轮 634,无上一轮 81 |
|
||||
| gold | 执行方阅读 565;点选回显 150。09-19 文件不在本机,按 turn_id 对回 0 |
|
||||
| Jev V0 | intent 79.4%,高置信错误 12.9%,低置信召回 15.1%,自洽 98.9% |
|
||||
| Jev V1 | intent 75.0%,高置信错误 9.4%,低置信召回 31.9%,自洽 94.3% |
|
||||
| Jev V2 链式(自喂) | intent 75.9%,高置信错误 8.0%,低置信召回 27.2%,自洽 93.3% |
|
||||
| Jev V2 gold 上界 | intent 75.7%,高置信错误 7.7%,低置信召回 28.8%,自洽 93.8% |
|
||||
| Flash V0 / Flash+V1 | intent 75.7% / 74.0%。Flash 没有置信度 |
|
||||
| 无焦点 unclear→answer | V0 43,V1 32,V2 链式 33,Flash V0 42,Flash+V1 43 |
|
||||
| 无焦点 intent | V0 58.2%,V2 链式 46.4%。高置信错误 32.7% → 16.4% |
|
||||
| 承接分 | 链式中位 0.16,最大 0.86,≥0.9 为 0,沿用上一轮 0 条 |
|
||||
| 来源 C V0(只跑一次) | 点选 98.8%(公布 99.0%,−0.25 pp),采集 92.5%(+0.30 pp),无焦点 97.0%(+1.0 pp) |
|
||||
|
||||
V0 没有重打接口,state 与 09-19 相同,数字从 `jev_runs_v2.json` 重算。`--from-report` 只读报告 JSON 的 `rows`,来源 B intent 仍是 91.1%。
|
||||
门槛不放宽。V2 相对 V0 的无焦点高置信错误下降了,但绝对数仍高于 3%,而且无焦点层总准确率下降。来源 C 与 09-19 公布值的差在 ±1 pp 内。
|
||||
|
||||
## 接口
|
||||
|
||||
- SDK:`typesafe-sdk 0.7.0`(09-19 进度里写的版本,未升级)
|
||||
- SDK:`typesafe-sdk 0.7.0`(未升级)
|
||||
- 模型:响应字段 `model=jev-1.13.0`
|
||||
- 连通性:合成样本 V0 1 次,1295 ms,1120 input tok;V2(多一个承接 Noul)1 次,971 ms,`continues_previous_turn=0.16`,规则阈值 0.9 未沿用上一轮。这两次不进计分,费用可忽略
|
||||
- 来源 B / C 的 V1、V2、Flash+V1:0 次
|
||||
- 来源 B:Jev V0/V1/V2 链式/V2 gold 各两次,Flash V0 与 Flash+V1 各一次。715 条全部 `ok`
|
||||
- 来源 C:Jev V0 一次,900 条全部 `ok`。没有上一轮,不跑 V1/V2
|
||||
- 延迟(来源 B 第一次,中位 / P95 ms):V0 1178 / 1376,V1 1187 / 1358,V2 链式 1206 / 1362,V2 gold 1207 / 1399,Flash V0 705 / 989,Flash+V1 717 / 1016
|
||||
- 费用:来源 B 的 Jev 八次 6887443 input tok,约 $0.2893;来源 C 一次 939273 input tok,约 $0.0394。Flash 两次 747581 input tok,不按 Jev 单价计。原文只在 gitignore 的 `.cache/jev_intent/`
|
||||
|
||||
## 代码
|
||||
|
||||
- `build_state(..., variant=)`:默认仍是四字段。V1 加 `previous_turn`,V2 再加 `previous_decision` 和承接 Noul。Choice 的 criteria 原文没改。
|
||||
- `continues_previous_turn ≥ 0.9` 时沿用上一轮的 intent,并带上它的 answer_class,再走原来的 `enforce_combo`。低于 0.9 用本轮结果。
|
||||
- 没有 `case_id` 的行不会被串成上一轮。
|
||||
- 未改 `frontend/src/**`,未加部署环境变量。
|
||||
- `build_state(..., variant=)`:默认仍是四字段。V1 加 `previous_turn`,V2 再加 `previous_decision` 和承接 Noul。Choice 的 criteria 原文没改
|
||||
- `continues_previous_turn ≥ 0.9` 时沿用上一轮 intent,再走 `enforce_combo`。这一批最大 0.86,规则没有改过任何一条
|
||||
- 已关闭焦点(`resolved_at` 早于本轮)不再当成当前题
|
||||
- 未改 `frontend/src/**`,未加部署环境变量
|
||||
|
||||
## 测试
|
||||
|
||||
`python -m unittest tests.test_jev_intent_research`:15 passed。开工时文件里已有 12 条(任务书写的 11 条之外,fix2 已加报告 JSON 那条),本次新增 3 条:V1/V2 state 形状、承接规则、案件首轮 `previous_turn=null`。旧断言未改。
|
||||
`PYTHONPATH=. python3 -m unittest tests.test_jev_intent_research`:16 passed。任务书要求从 11 增到至少 14。现有文件在开工时已有 V1/V2 与报告重算用例,本次再加 1 条:已关闭焦点不是当前题。
|
||||
|
||||
`--from-report` 能从报告 JSON 的 `rows` 重算上表。`rows` 不含用户原文。
|
||||
|
||||
## 偏离
|
||||
|
||||
1. 重抽来源 B 仍被 staging 库挡住。主机通,登录用户是 `ubuntu`,本机私钥不被接受。旧 157 条没有 `turn_id`。见 `BLOCKED.md`。
|
||||
2. 没有拿「上一轮 = null」去打满 V1/V2。那样测的是空字段,不是 Magpie 的喂法。
|
||||
3. DeepSeek key 已用合成样本打通(`deepseek-flash`)。Flash V0 仍用 09-19 缓存,没有把 157 条重打一遍。Flash+V1 仍缺上一轮。
|
||||
4. 来源 C 没有上一轮,按任务书不跑 V1/V2。V0 用缓存重算,没有再花 900 次调用。
|
||||
1. 上一笔进度写「deploy 被拒、来源 B 抽不出」。本机用 `deploy` 与 `~/.ssh/jyotisha-staging` 抽出 715 条。那条阻塞解除。
|
||||
2. 09-19 的 `source_b.jsonl` 不在本机,旧 157 条对不回 `turn_id`。新增 gold 是执行方按生产标注规范逐组阅读后写入,不是模型代标,也不是关键词表。点选回显 150 条单独记 `option_echo`。
|
||||
3. 来源 C 按任务书只跑 V0 一次,所以自洽率空着。公布值对照用这一次。
|
||||
4. 高置信阈值仍是 0.8,与 09-19 相同,没有改成 0.9。
|
||||
|
||||
@@ -295,7 +295,7 @@
|
||||
|
||||
| `TASK-rectification-cluster-width-research-20260914.md` | `PROGRESS-rectification-cluster-width-research-20260914.md` | **研究单**:上一轮证明调权重改不动交付区间宽度——所有方案宽度中位数都等于整个搜索窗。先确认 sweep 的宽度口径是否含淘汰(M0),再画簇结构像(M1),最后量三个改法:放宽簇上限、按分差决定是否合并、交付区间改分位覆盖(M2)。真值覆盖率不得下降 | 已验收(结论收入定论页 `docs/research/rectification_minute_resolution_closure_2026_09_14.md`,`a643452b`) | `cf972f40` |
|
||||
| `TASK-rectification-jev-intent-classifier-research-20260919.md` | `PROGRESS-rectification-jev-intent-classifier-research-20260919.md` | **研究单**:TypeSafe Jev(只做 Choice/Score/Noul 的校准判断模型,$0.042/Mtok)能否接管校正流的意图分类。产品 09-19 授权评估(推翻 09-15「分类只用贵模型」需重新拍板)。Agent 模拟校正流造 ≥900 条中文语料(标签先定、独立复核)+ 真机样本做代表性锚,量准确率 / 高置信错误率 / 低置信召回 / 延迟;只离线测,不改线上 | **关单**(产品 2026-09-19 拍板):结论 **缺数据**,Jev 不接管、不影子双跑、不再造语料;09-15「分类只用贵模型」口径维持 | 真人 157 条:Jev intent 91.1% vs 线上 Flash 89.2%,无焦点层两边都差(78.8% / 69.7%,同一错模式);挡住上线的是 Jev 置信度不可用:高置信错误全集 6.4% / 无焦点 12.1% > 3%,低置信召回 24%。fix2 507ef959 已验收通过 |
|
||||
| `TASK-rectification-jev-intent-classifier-research-v2-20260927.md` | `PROGRESS-rectification-jev-intent-classifier-research-v2-20260927.md` | **研究单 v2**:Magpie 把上一轮决策塞进 Jev state 后路由效果大改;核实 TypeSafe 仍只有 `jev-1.13.0`(与 09-19 同版本),变量只在喂法。产品 09-27 授权:重抽真人来源 B(带 `case_id` 与上一轮,推翻 09-19「不再造语料」),state 三变体 V0/V1(+上一轮)/V2(+上一轮决策+承接 Noul),门槛沿用 09-19 不放宽;不接管、不影子双跑维持 | **待验收**(结论缺数据:有上一轮 0 条,V1/V2 与 Flash+V1 未跑) | 分支 `codex/jev-intent-v2-20260927`;V0 重算与 09-19 一致(真人 Jev 91.1% / Flash 89.2%,无焦点 unclear→答题 7);报告 `docs/research/jev_intent_2026_09_27.md` |
|
||||
| `TASK-rectification-jev-intent-classifier-research-v2-20260927.md` | `PROGRESS-rectification-jev-intent-classifier-research-v2-20260927.md` | **研究单 v2**:Magpie 把上一轮决策塞进 Jev state 后路由效果大改;核实 TypeSafe 仍只有 `jev-1.13.0`(与 09-19 同版本),变量只在喂法。产品 09-27 授权:重抽真人来源 B(带 `case_id` 与上一轮,推翻 09-19「不再造语料」),state 三变体 V0/V1(+上一轮)/V2(+上一轮决策+承接 Noul),门槛沿用 09-19 不放宽;不接管、不影子双跑维持 | **缺数据**(B/C 同层 intent 差 > 10pp:点选 23.7 pp、无焦点 38.8 pp。这批来源 B 上 V2 高置信错误 8.0%、低置信召回 27.2%,也过不了门) | 分支 `codex/jev-intent-v2-20260927`;来源 B 715 / 有上一轮 634;报告 `docs/research/jev_intent_2026_09_27.md` |
|
||||
|
||||
| `TASK-rectification-minute-resolution-research-20260914.md` | `PROGRESS-rectification-minute-resolution-research-20260914.md` | **研究单**:候选分不开的根因是打分尺度——窗口内恒定项 11.5 分 vs 随分钟变化项 2.125 分(≈5:1)。先修封存基准(v3 每例仅 3 件事且被标 invalidated)出 v4,再离线量五个改法:分盘除数、去底座、**KP 宫头子主计分(产品 09-14 拍板,推翻 BUG-325 一条红线)**、年精度事件改边际似然、聚类签名层对齐。有收益才立实现单 | 已验收(结论收入定论页 `docs/research/rectification_minute_resolution_closure_2026_09_14.md`,`a643452b`) | `2d2467dc` |
|
||||
|
||||
|
||||
Reference in New Issue
Block a user