# 新业务情境：从笼统拦截到具体补证

本轮用三份从零构造的合成数据检查：四周总体良好时，最近一周的问题是否仍能进入判断。任务方指定挑战方向与约束，另一开发子任务在未读被测实现的情况下编写样本；这不是独立留出集，也没有真实品类负责人参与。

**实际结果与最初猜测不同：修复前三例全部 INVESTIGATE，均因为“局部门店异常”。没有观察到三例全部误放行为 ACT。** 问题是建议缺乏具体诊断，并且稳定参照也被相同规则拦住。冻结前卡片与源码保留，输入未为迎合结果而调整。

| 情境 | 四周促销增量估计 | 末周试点贡献 | 末周最差池缺货 | 原建议 | 修复后建议 |
|---|---:|---:|---:|---|---|
| X01 末周贡献转负 | ¥1368.00 | ¥-708.00 | 0.0% | INVESTIGATE | INVESTIGATE |
| X02 局部末周缺货 | ¥882.00 | ¥990.00 | 20.0% | INVESTIGATE | INVESTIGATE |
| X03 稳定正向参照 | ¥960.00 | ¥1068.00 | 0.0% | INVESTIGATE | ACT |

## 现在具体会交给谁处理

- **X01**：暂缓提出试点续行或扩大建议；财务核对末周目标商品的单位成本、促销费用凭证与生效日期，区分记录问题和真实经营变化，将结果交品类负责人复核。 负责人：Category Manager / Finance；2 天内复核。[原卡](before_cards/X01.json) · [当前卡](after_cards/X01.json)。
- **X02**：暂缓提出试点续行或扩大建议；门店与供应负责人核对指定渠道的缺货事件、补货时点和当前可售库存，确认能否支持下一周试点，将结果交品类负责人复核。 负责人：Category Manager / Store Ops / Supply；2 天内复核。[原卡](before_cards/X02.json) · [当前卡](after_cards/X02.json)。
- **X03**：建议在既有合成授权内延续 7 天小范围试点；仅形成建议，不执行价格、订货或促销。 负责人：Category Manager / Promotion Owner / Store Ops；7 天内复核。[原卡](before_cards/X03.json) · [当前卡](after_cards/X03.json)。

这些字段已进入 [经营看板](dashboard.html) 和给模型的证据输入。模型现在能看到周度信号；本轮没有再次调用模型，因此未验证它是否真的更好地解释或追问。

## 判断边界

- 四周增量估计与末周经营状态是不同问题。单周贡献转负或缺货只支持专项核查，不能自动推导长期失败、需求改变或人员责任。
- 正向门店差异只在完整可信试点、实际处理门店、相对同簇为正向、试点及全店贡献未恶化时不再单独否决；其它授权、质量、时效、损耗和可售率要求仍保留。
- X03 的 ACT 仍只是受限建议，须人批准。它不是证明现场一定应该继续，也不是实际执行。
- 三例参与了补丁设计，修复后结果只作回归示例。原 20 份模型实验及其 34/54、54/54 结果保持原样。没有新模型胜率、真人决策改善率或经营 ROI。
- 作者最初的四周增量汇总漏了处理/对照池数量归一化，已用原始 CSV 的 Decimal 计算纠正；三份数据未变。原说明保留在 `author/AUTHOR_NOTES.original.md`，以修正说明和本页复算为准。

## 交给业务人员时要验证什么

先请对方独立阅读原始数据和四周指标，再查看卡片，并记录：原先是否漏看末周风险；卡片是否改变了下一步；建议核对的凭证/负责人是否合适；有没有遗漏的风险或不必要的拦截。该顺序会产生学习效应，只能作探索性访谈，不应并入四组盲测分数。当前尚无这些真人反馈。

复现：项目目录执行 `python3 -B scripts/review_business_cases.py`。原始输入在 `data/business_challenges/cases/`，同输入指纹、当前源码指纹与逐项复算见 [results.json](results.json)。复核脚本只更新当前结果，保留冻结前卡片与原始输入。
