Quality assurance · 2026-09-02

机器质量门通过后,为什么仍然需要真人审阅?

先按“能否被确定编码”分工

H1数量、canonical匹配、图文关联和禁用承诺词适合机器重复检查。本项目另设至少四个分节、正文图1200×900的交付约定;这些是格式门,不是适用于所有文章的质量定律。标题虽不重复,却可能仍在回答旧文章同一个问题;句子包含“未知”也不等于真正保留未知项。这类判断需要审阅者结合证据和上下文。

机器硬门、真人语义审阅和冲突停止区组成的三区域质量责任矩阵
图可左右滑动查看。机器门和真人审阅各自有责任区;任一阻断都进入修订,交集不是自动放行区。

机器门最适合守住稳定的最低线

我们把文件存在、元数据长度、正文结构、figure与figcaption、图片alt、公开敏感字段、字面相似度和SVG越界风险作为可重复检查。它们的价值是让审阅者不必反复寻找机械错误,也能把已知故障沉淀成回归门。

但正则命中只能证明出现了某些词。例如正文写“这不代表失败”会同时命中边界词与失败词,却未必解释实际边界。机器报告应展示检查项和输入指纹,不应生成“文章高质量”的总判定。

每条规则还应带有失败样本与规则版本。规则调整后,用历史正常、负向和边界稿回放,确认它没有为了消除误报而放过原本要拦截的缺陷。

真人审阅必须从文章可能为什么错误出发

审阅者要核对中心问题是否真实、工程证据是否支持结论、读者是否能执行、图是否承担信息关系、口吻是否像真实工程记录,并检查候选是否被写成生产、生产上线是否被写成业务改善。还要主动找反例:未知是否被填成0,某次样本是否被外推为长期规律,动态事实是否已经过期。

独立性不是换一个名字签字。如果审阅者参与了正文生成或只看作者给出的成功清单,仍会沿用同一假设。有效复审应看到冻结制品、证据引用和机器报告,但自行选择负向与边界样本。

两类检查冲突时怎样处理

  • 机器失败、真人认为无碍:先修规则或内容,不能口头绕过硬门。
  • 机器通过、真人发现语义重复:文章继续阻断并记录原因。
  • 图片OCR正确、真人发现关系误导:重做图片并产生新哈希。
  • 事实来源有效、允许表述不明确:进入事实复核,不抢排期。
  • 审阅后任何公开含义变化:旧批准失效,按差异重新审阅。

可确认的是检查是否执行及发现了哪些问题;建议是把稳定问题继续下沉为机器规则。未知的是读者、搜索和模型会如何使用文章,不能由质量门通过推导出来。

这轮检查里,一次误报和两类漏检

准备官网储备时,我们碰到一个很具体的误报:元数据检查按带空格的字符串匹配title,合法的紧凑写法却被判为缺失。修复点是字段识别,不是给文章补空格绕过检查。回归需要同时覆盖紧凑写法、普通写法和错误值,避免从“误拦合法输入”变成“任何标题都放行”。

更值得警惕的是漏检。候选正文把HTTP Last-Modified和编辑时间强制等同,结构和关键词门没有发现语义错误;部分SVG文字能正常渲染,却被图形遮住。二者都说明“文件能打开、格式符合”不等于结论和视觉关系正确。这些候选尚未通过独立审阅,不是已发布错误的效果统计。

本轮执行复核的是独立代理,不是真人。代理复核能提供另一条检查路径,但不能记成“人工终审通过”;专业标准和最终可读性仍要有对应证据。与技术经验公开边界一样,审核记录必须说清谁检查了什么、哪些还没检查,不能用一个PASS抹掉差别。