P358 · 上下文管理

只使用决策时点已知的信息

Point-in-Time Context Admission

回放历史任务时,不引入当时还不可用的后续信息。

编辑审核

以下示例与示意结果由本站编写,用于说明方法,不是模型实测结果。

使用场景

你评估事故助手在 10:05 决策时点能否合理排查,后来已知道根因。教学材料:R1 事件/可得时间均为 10:02;R2 事件 10:03,但记录到 10:12 才可读;复盘 R3 在 11:00 发布。未来信息可以作评测参考,不能偷偷进入历史输入。

具体做法

固定决策截止点和数据快照,分别记录事件发生时间与资料实际可得时间。只有截止点前可得的材料进入回放;晚到记录、后续修正和复盘留在标签或分析路径。未知可得时间单列,不能仅凭事件发生早就纳入。记录构建规则,方便重复检查输入是否泄漏。

反例

在 10:05 的历史回放中使用 R1、R2 和 11:00 的根因复盘。R2 事件在 10:03,所以它肯定已可用;然后宣称助手能从早期证据直接找出根因。

改进写法

为上述教学评估固定截止点 10:05。输入只包含当时可得的 R1;R2 虽事件较早,但 10:12 才可读,应排除;R3 复盘只用于事后评价,不进模型输入。逐项记录可得时间与来源。未知时间标为缺口,不猜资格。保留快照和输入/标签分离,以相同早期证据评价助手。

为什么这样改

事后知道根因很容易改变看待早期证据的方式。按可得时间筛选能防止晚到记录和复盘虚增历史决策能力,区分事件先发生与系统当时已掌握。

如何验证

示意输入清单只有 R1,排除表记录 R2=晚可得、R3=事后标签。检查模型输入中没有复盘根因或后来修正的字段。

可得时间不明的记录不自动通过;如果评估结果引用 R3 的事实,先核查是否有泄漏。本篇没有真实模型评测。

适用边界

这条时点边界用于历史回放、预测或评测;当前工作可能需要最新信息。可得时间、版本与权限都影响材料资格,不能只过滤一个 timestamp 列就保证完全无泄漏。

原文与版本

如何收录这些方法