# 生鲜损耗与补货：一个完整的合成决策案例

目标是比较单店单品未来三天的维持订货、减少订货、首日折价，并在补证及模拟复盘后重新判断。四张卡是同一案例的四个信息状态，不是四个独立样本。无人参与、无真实执行，数值不代表盒马业务。

期初有 90 份当日到期商品与 60 份第三日到期商品，单位成本 ¥6，常规价格 ¥10。维持方案次日新增 120 份，减量方案新增 60 份；折价方案首日 ¥8，另有 ¥20 费用，但需求反应未知，因此不计算其精确收益。

| 信息状态 | 系统判断 | 具体变化 |
|---|---|---|
| F01：需求范围较宽 | INVESTIGATE | 减量相对维持的贡献变化为 −¥240 至 +¥360；高需求下未满足比例达 23.1%，先补需求证据。 |
| F02：补充更窄的假设范围与数量审核记录 | ESCALATE | 给定情境内减量贡献改善均为 ¥360，未出现缺货；提交品类/采购人工商业复核，仍不声称最优。 |
| F03：提供假设执行后的合成复盘记录 | INVESTIGATE | 贡献 ¥440，但记录了 12 份未满足订单，12/(170+12)=6.6%；重新核对需求范围与下一周期订货。 |
| F04：批次数量来源与计划冲突 | ESCALATE | 来源为 132 份而计划为 150 份，暂停精确方案测算并要求对账。 |

[打开经营看板](dashboard.html) · [无建议的数据视图](dashboard_only.html) · [逐项输出与源码指纹](results.json)

## 数字和权利边界

- 每天先收货，再按先到期先售；到期日仍可售，日终剩余按成本报损。这是显式模拟约定，不是食品安全或门店操作指令。
- 贡献额 = 收入 − 已售商品成本 − 到期报损成本 − 方案费用。采购现金单列，期末库存保留账面价值，避免重复扣成本。
- 三条需求路径没有概率；¥360 仅在给定条件下成立，不是预测、因果增益、真实利润或长期收益。缩窄假设本身也需要业务人员质疑。
- 库存、需求与数量审核记录都是合成声明。系统核查来源日期、范围、角色、明细和冲突；external_authenticity 始终为 not_verified。
- 改价、订货和供应承诺交人决定；所有卡均 requires_human_approval，execution_status=not_executed。F03 是假设后续记录，未发生真实试点。
- 历史四周 POS/P&L 与三天方案测算分别展示。旧 20 份模型记录保持不变，本扩展不改写原分数。

## 验证与尚未完成的部分

- 两份未读实现的开发子任务另行编写的数值案例：当前 48/48 字段匹配。它们测试批次成本与已承诺到货，不证明经营有效性。
- 首次核验为 45/48；三项差异来自作者手算的成本勾稽错误，原始期望与第一次结果均保留。修正期望前先按批次守恒复算，输入和被测计算实现未为迎合答案而改动。
- 模型组件比较：partial_or_blocked，保存成功响应 0/4。R 为无模型系统，G 获得相同预计算事实，C 另获得固定决策卡；两模型组均无交互式工具调用。
- 这不是开放计算工具通用助手的性能排名。引用存在只验证来源 ID，不证明推理正确；补证问题的价值仍需业务人员评审。
- 真人 Dashboard / Human+Agent 比较未运行，真实数据接入、来源认证、审批与业务执行闭环未完成。

## 给业务人员的复核表

请记录下面每项的具体依据，不必给笼统满意度分数：

| 复核问题 | 真人记录（当前未填写） |
|---|---|
| 未看建议前，会选择什么动作？缺什么信息？ | 未参与 |
| 哪条风险或方案代价原先漏看了？ | 未参与 |
| 需求范围缩窄是否有足够依据？ | 未参与 |
| 补证问题的对象、优先级和业务价值是否恰当？ | 未参与 |
| 是否改变行动，核查耗时是否减少，是否出现无效拦截？ | 未参与 |
| 复盘后是否应撤回建议，还缺哪些现场事实？ | 未参与 |

顺序阅读会产生学习效应，访谈不自动计入四组盲测。源码运行：`python3 -B scripts/review_fresh_case.py`。显式模型调用另加 `--run-models`，会消耗已有订阅额度；仅允许无记录的新一轮，失败不自动重试。
