修订提示词时隔离保留样本的反馈
Keep selection feedback out of revision prompts
不把保留样本的结果透露给改写提示词的模型,并准确描述筛选样本的用途。
以下示例与示意结果由本站编写,用于说明方法,不是模型实测结果。
使用场景
路由描述按训练失败改写,保留查询用于每轮选赢家。即使修订模型没有读这些查询,只要其分数用于反复选择,这组仍是验证/选择集而非最终独立测试。
具体做法
先固定训练、选择和最终确认样本身份及允许反馈。修订输入仅含训练材料,过滤历史中的保留字段,检查完整提示及引用文件是否侧漏。选择集用于挑候选并如实命名;最终测试留到选择结束,若其反馈进入新修订就不再是未触碰集。存储阈值与历史分数标历史,未独立复核门槛标暂定。
反例
每次把保留失败例交给修订者,仍称最佳分数是未触碰测试表现。
改进写法
修订者只读训练失败与过滤后的历史,选择候选用单列验证集分数;最终确认在未参与选择的新案例进行。记录各集合身份及反馈访问,结果只称实际支持的范围,不把固定阈值当新评估。
为什么这样改
信息隔离减少直接案例泄漏,但自适应选赢家仍使用选择信息。准确命名能防止验证集高分被包装成独立泛化估计。
如何验证
教学提示快照不含选择案例或分数字段;选择表与最终测试表各有ID。若最终失败被拿去改下一版,该集合改为开发反馈并另需新的确认。检查文件引用和聊天历史,不能只删除一个字段就声称完全隔离。
适用边界
小样本可能只能报告方向性结果,不必虚构三分割。重复样本不能自动变独立案例,确定语料也不能伪造群体置信区间。冻结来源有“test”名用于选择的情况,正文按真实用途说明。
原文与版本
- anthropics/skills · Blind history and selection
查看此版本的文件8a1541c4a3ff - anthropics/skills · Generalize intent instead of enumerating cases
查看此版本的文件8a1541c4a3ff - anthropics/skills · Two-way selection versus optional untouched final test
查看此版本的文件8a1541c4a3ff - anthropics/skills · Selection is not holdout
查看此版本的文件8a1541c4a3ff - nextlevelbuilder/ui-ux-pro-max-skill · Explicit calibration/held_out case labels; partial illustration of channel separation
查看此版本的文件09170eec67ee - nextlevelbuilder/ui-ux-pro-max-skill · Declared tuning exclusion for held_out and provisional comparison boundary
查看此版本的文件09170eec67ee - nextlevelbuilder/ui-ux-pro-max-skill · Stored held_out summary, not a fresh evaluation result
查看此版本的文件09170eec67ee