说明测量到底统计了什么
Measurement Unit and Scope Boundaries
先声明计数单位和范围,再用结果支撑其他资源或行为方面的判断。
以下示例与示意结果由本站编写,用于说明方法,不是模型实测结果。
使用场景
JSONL快照共1,000字节,附件记录800字节。用户问模型还剩多少上下文,这个存储统计只能回答落盘占比,不能推出活跃token或剩余空间。
具体做法
先声明测量对象、单位、时间与分类规则;把附件、其他与未分类字节完整对账,包含行尾和空行。报告800/1,000=80%仅为落盘占比。活跃上下文和剩余空间使用适用运行时独立观察,不可用则未知;记录运行器版本与指标含义,不混成账单。
反例
附件800/1,000,所以占模型上下文80%,还剩20%;字符、字节、token都一样。
改进写法
报告快照总字节和分类:附件800,占80%落盘字节;活跃token、剩余空间及重连加载未测。若有获授权且支持的运行时用量面板,单独读取并标来源,不能用存储比例替代。
为什么这样改
单位和加载策略不同,正确的字节算术仍不能跨到token。范围标签让有效存储结果可用,同时阻止超出测量能力的资源判断。
如何验证
教学分类800附件+150其他+50未分类=1,000,未分类不能悄悄归会话文本。报告80%存储与上下文未知两项。重复读同一快照也不产生新运行时证据。
适用边界
压缩、二进制表示、缓存和模型输入转换会改变关系,未知不能补零。有效字节统计可帮助存储分析,不必因不测token而否定;运行时命令与支持范围须按实际版本核查。