方法
七个步骤,21 张工作表。这一页说清每一步的输入、输出和约束。
如果只想看结论,首页第五节有摘要表。这一页是给想验证方法是否站得住的人看的——包括面试官。
一、流程
买家问题 → 证据要求 → 证据 → 声明 → 人工复核 → URL 行动 → 复测
第 1 步:买家问题
按采购、工程、质量、终端用户四类角色,把「这家供应商行不行」拆成可以逐条回答的问题。
不从网站结构正推(「首页要有什么」),而从买家决策倒推(「他要向老板证明什么」)。
一个合格的买家问题必须可判定。「产品质量好不好」不合格,因为无法判定。「额定压力是否标注了测试条件与引用标准」合格,因为答案只有是、否、部分三种。
范围:快速体检 5 个,标准审计 15–20 个,深度审计 25–32 个。
第 2 步:证据要求
在采集页面之前,为每个问题写死它的证据要求:需要哪类材料、哪些字段、什么粒度算充分。
这一步的顺序是整个方法的关键。如果先看页面再定标准,标准会不自觉地向已有内容靠拢,报告就失去了约束力。
例:问题「ISO 9001 是否可核验」的证据要求是:证书编号、发证机构名称、有效期、以及可下载文件或第三方验证链接。四项齐全为充分,缺任意一项为部分,只有一句文字声明为缺失。
第 3 步:证据
采集公开页面样本,每个 URL 保存抓取时间戳和内容 SHA-256。
为什么要哈希:一是复测时能确认页面真的改了,而不是靠记忆比对;二是报告里每条结论都能指回一个特定时刻的特定页面版本。你三个月后回头看这份报告,能确认它当时看的是什么。
不登录、不提交表单、不访问后台。robots 禁止的路径不采。
第 4 步:声明
把采集到的内容登记为八种声明类型之一:
| 类型 | 含义 |
|---|---|
business_verified | 客户提供了可核验材料并经确认 |
business_attested | 客户书面确认,但无第三方材料 |
observed | 在公开页面上观察到,未经验证 |
calculated | 由其他数据按公式算出 |
third_party_estimate | 来自第三方来源的估算 |
inferred | 推断,标注为推断 |
recommended | 建议,不是事实陈述 |
unknown | 无足够证据 |
网站上写的东西默认是 observed,不会自动升级为 verified。这是本方法最容易被误解的一点:我们记录「站上这么写」,不记录「这是真的」。升级到 business_verified 需要你提供材料并确认。
第 5 步:人工复核
以下类别的内容强制进人工复核队列,不由自动判定结案:
认证、合规、安全、性能极限、价格、客户案例、产能、交期、质保、冲突项、低置信度声明。
复核队列交给你的质量、工程、法务或业务负责人确认。报告交付时这些项目通常仍是 pending 状态——这不是遗漏,是设计:这些事实的裁定权在你,不在审计方。
第 6 步:URL 行动
每条行动包含:URL、问题、当前证据状态、建议行动、优先级、预期影响。
优先级由公式计算,输入是买家重要性、缺口严重度、事实就绪度、业务影响。不由模型估——关键数学一律由表内公式或代码算,避免口径漂移和算术错误。
行动写法是「哪个页面、加什么、为什么」,可以直接转给建站团队,不需要对方理解方法论。
数量:快速体检 3–5 项,标准审计 8–15 项,深度审计 15–20 项。
第 7 步:复测
你实施后重新采集,对比前后快照与哈希,更新证据状态。
前提是已实施至少 3 项建议,且在初次交付后 30 天内。复测报告显示哪些状态真的变了,哪些没变。
二、证据状态分类
每个买家问题最终落到五个状态之一:
| 状态 | 含义 |
|---|---|
sufficient | 证据满足预先定义的要求 |
partial | 有证据但不满足全部要求字段 |
missing | 应有证据但页面上没有 |
conflict | 多处内容互相矛盾 |
unknown | 无法判定 |
conflict 在多站点客户里特别常见:主站写质保 12 个月,产品站写 24 个月。买家看到两个数字时不会挑对自己有利的那个信,他会认为这家公司内部管理有问题。
加权证据覆盖率 = 按买家重要性加权后的充分程度。两个已执行案例分别是 45.09% 和 42.16%。
三、核心原则
unknown是合法且必需的输出。没有证据时禁止补全。一份没有任何unknown的审计报告,大概率是在编。- 先定标准,再看答案。证据要求在采集之前写死。
- 网站自述不是已验证事实。
observed与verified之间必须有人工确认。 - 高风险事实由客户裁定。认证、性能、产能、案例的真伪不由审计方下结论。
- 关键数学由代码或公式算。不让模型做算术。
- 保存快照与哈希。可复现、可复测、可追溯。
- 发现的是证据缺口,不是企业事实的真假裁决。「证书编号未公开」不等于「没有认证」。
四、工程实现
方法固化在一个 21 张表的工作簿里,不是一份文档模板:
Client_Intake、Source_Registry、URL_Snapshot、Business_Facts、Buyer_Questions、Evidence_Requirements、Evidence、Claims、URL_Actions、Human_Review、Client_Report、Time_Log、Adoption、Payment、Blind_Control、Assumptions、Gold_Tests、Scorecard 等。
其中几张表值得单独说:
- Gold_Tests — 回归测试集。用于验证判定规则不会把无证据的声明升级为已验证。方法本身也要被测试。
- Blind_Control — 记录哪些发现原本已在客户自己的 SEO/内容待办里。用于诚实衡量增量价值:如果发现的问题客户早就知道,这份报告的价值就要打折,我希望这一点被测出来。
- Time_Log — 记录实际活跃人工分钟数。当前有意留空,不用机器运行时间冒充人工工时。
- Scorecard — 输出
GO/STOP。要求真实付款、真实采纳、真实工时。两个已执行案例都是STOP,如实公开。 - Assumptions — 假设登记表。写下方法依赖的未验证前提,而不是让它们隐含在结论里。
五、这个方法不做什么
- 不做 SEO 关键词、排名、外链分析
- 不保证询盘、排名、转化或收入
- 不判定企业声明的真假
- 不代办认证或合规手续
- 不修改客户网站或 CMS
- 不做竞品情报
- 不要求密码、CRM、原始询盘或 PII
- 不含内容实施(修改、翻译、上传)
六、已知局限
诚实记录方法本身的弱点:
只看公开页面,看不到线下材料。很多制造商的证书和测试报告是邮件发给客户的,不放在站上。这种情况下报告会显示「缺失」,但真实情况是「未公开」。区别在报告里会写明,但覆盖率数字本身无法体现这个差异。
加权靠判断。买家重要性的权重来自对采购流程的理解,不是统计数据。不同行业、不同市场的真实权重可能不同。
匿名化不等于不可识别。公开案例披露了产品线类别、页面数量和技术统计,掌握行业背景的读者仍有可能反推出企业。已通过去除具体数值和城市名降低,但无法归零。
样本量不是全站。30 或 80 个页面是样本,不是普查。样本外的页面可能有不同的证据状态。
工时估算未经真实计量。套餐范围对应的实际工时目前是估算,首轮成交后校准。