P283 · 测试与评估

汇总前区分增量与累计计数

Establish counter semantics before totals

先确认指标是本次增量还是累计读数,避免重复计入总数。

编辑审核

以下示例与示意结果由本站编写,用于说明方法,不是模型实测结果。

使用场景

同一会话累计token读数为100、140、200,要算第一次到最后一次之间用量。相加得到440重复计入历史;另一个统计任务可能要每个调用最终累计总量,边界不同。

具体做法

先查字段契约:增量/累计、单位、会话或调用身份及区间起点。增量按不重叠记录相加;累计区间用终点减起点,跨重置分段。每调用总量取一次有效最终快照,再按不重叠调用汇总。缺失保持未知,父子计数包含关系先确认;token、字符、成本及缓存分类不能互换。

反例

把100+140+200当区间用量440;缺中间记录补0,output_chars也当token。

改进写法

这些是同一计数器累计值,区间从100到200的用量为100。已观察中间增量40与60可分列;缺中间则仅支持总区间,不猜逐轮。另汇总调用时只取一次最终累计,检查重置和父子重复计入。

为什么这样改

累计读数重复含之前使用量,语义和边界决定如何聚合。身份去重与分类防止把采样、嵌套计数或不同单位误加成账单。

如何验证

教学200−100=100,140−100=40、200−140=60;累计200到10可能重置,不能报告负190或默认新10全属本区间。重复最终快照200只计一次;缺起点的区间标未知。

适用边界

提供方用量字段和缓存定义不同,应读取实际文档/响应。字符估算不是实测token,token也不直接等于货币。账单还需模型、价格依据和失败尝试,冻结来源费率不代表当前价格。

原文与版本

如何收录这些方法