排查特殊后缀域名时,缓存假象的典型表现是:同一URL在不同人、不同网络、不同工具下返回不同内容,或修改后仍看到旧页面。要排除它,核心原则是先固定观察条件,再对比来源,最后回到源站验证。下面是一份可执行清单,每项都说明查什么、怎么查、结果说明什么。
特殊后缀域名常见的缓存层包括:浏览器本地缓存、系统或公司网络中间缓存、CDN边缘缓存、源站页面缓存与对象缓存。排查时不要一上来就清缓存,而要先判断“旧内容”来自哪一层。
Cache-Control、Age、ETag、Last-Modified、X-Cache、CF-Cache-Status(若使用对应CDN)。curl -I https://example.test/page 与 curl -I "https://example.test/page?cb=20240101"。这里 example.test 是假设域名,仅作演示。多人协作时,最容易返工的原因是“我这边好了”被当成“已经好了”。需要把观察条件写清楚并交叉验证。
加随机查询参数、使用开发者工具禁用缓存、切换无痕模式,都只是绕过缓存来观察源站,不等于已经修复了缓存问题。特殊后缀域名还可能因为解析、重定向或路径规则导致不同入口命中不同缓存键。
www、带与不带结尾斜杠是否落到同一资源。curl -IL 跟踪重定向,确认每一跳的状态码和最终URL;再对比最终URL的响应体关键字段。排查缓存假象时,常有人把 robots.txt、站点地图、HTTPS 当成万能解释。需要明确:robots.txt 的抓取限制不等于可靠的索引移除;站点地图不保证收录;HTTPS 不保证安全无漏洞或排名。它们不能直接证明你看到的旧内容就是缓存造成。
robots.txt 允许抓取;页面是否返回 noindex;站点地图是否包含该URL。/robots.txt 核对规则;查看页面响应头或HTML中的 <meta name="robots">;在站点地图文件中搜索该URL。为了减少返工,交付记录不要只写“已刷新缓存”。建议按下面格式留痕:
Age 是否下降、X-Cache 是否从命中变为未命中、源站响应体是否已更新。下一步:选一个仍显示旧内容的URL,按“响应头—多网络—源站—抓取索引”的顺序各记录一次结果,再把无法复现的条件单独列出,交给协作方复测。