P107 · 测试与评估

让新 Agent 试读文档

Reader Testing with Sub-Agent

检查没参与之前讨论的读者能否独立理解文档。

编辑审核

以下示例与示意结果由本站编写,用于说明方法,不是模型实测结果。

使用场景

发布手册由熟悉项目的人编写,正文只说“执行标准回退”,起草讨论中才有具体命令。新值班员没有那段历史,试读应检测这处缺口。

具体做法

明确目标读者及可允许的参考资料。在获授权的独立上下文中只提供手册、目标和问题,不附起草历史或作者答案;要求定位回退步骤、触发条件和前提,引用文档。记录回答正确、无法回答和误解处,修正文档后用同等独立条件复测。试读只是阅读,不实际执行发布动作。

反例

作者确认手册看得懂;把整个起草对话发给新读者,提示正确回退命令再问其是否理解。

改进写法

只给新读者手册与值班员受众信息,请其从文档找到回退命令、说明触发和权限前提,引用位置;缺失就说无法找到,不能使用作者历史补全。修订后复测相同阅读任务,记录仍未解决的疑点,不执行回退。

为什么这样改

去掉作者历史,才能检验文档是否独立承载必要信息。要求引用比“看懂了”更可检查,能区分真实可读性与模型凭背景补出的答案。

如何验证

教学初稿应得到“标准回退命令未定义”,不能凭空给命令。补入步骤和触发后,新读者能引用对应段落并指出未说明的权限。保留前后回答及文档版本,不能只记录作者满意。

适用边界

新的模型读者仍可能共享偏差;重要手册还需真实目标用户试读。可允许外部参考,但必须明确哪些是文档自足能力。冻结来源不是当前任务的派生代理授权;无法隔离上下文时须如实标明检查限制。

原文与版本

如何收录这些方法

相关方法