
网站上线后通常会先打开页面检查样式有没有错位、按钮能不能点。还有些设置没那么显眼标题可能还用着模板里的默认内容测试时禁止收录的设置noindex忘了去掉。有时还需要确认页面上的介绍文字是不是全部依赖 JavaScript 加载。Crawlmark 就是用来检查这些细节的小工具。输入一个公开网址它会列出检查结果、判断依据以及需要进一步确认或修改的地方。适合博客、项目主页或产品介绍页上线后顺手做一轮基础排查。工具已经开源不用注册可以直接在线试用。下面拿一个实际页面跑一遍。输入网址后能看到什么在输入框里填入完整网址点击「Inspect page」即可。现在的界面是英文常用操作只有检测、筛选和下载报告。这次检测的是 Rowglass 的项目主页。Rowglass 是一个 CSV / JSON 数据对比工具下面是它的主页在 2026 年 9 月 5 日的实际检测结果报告列出了 13 项检查。点击「Needs attention」可以先把已经通过的项目收起来只看需要处理或确认的部分。这次留下了三项没有找到 canonical也就是用于提示首选网址的标签没有找到主标题 H1没有检测到正文文本。后两项看起来有点奇怪——网页明明能打开怎么会没内容原因是 Crawlmark 读取的是服务器返回的初始 HTML不会运行页面里的 JavaScript。这个结果提醒我们检查内容的加载方式而不是说浏览器里的页面真的空了。如果这是一个主要用来介绍产品的页面就可以继续看看标题和介绍文字是否都要等脚本执行后才出现是否值得把关键内容直接放进 HTML。至于 canonical则可以结合是否存在多个内容相同的网址再决定要不要补。查到问题后不用重新猜一遍原因每项结果下面都有判断依据和下一步建议还附了参考链接。比如页面带有 noindex报告会把这个收录限制列出来。你可以据此确认这是还没去掉的测试设置还是本来就不希望公开收录。目前检查的内容主要有三类访问设置HTTP 状态、重定向、HTTPS以及 Googlebot 对应的 robots.txt 规则。页面信息标题、描述、主标题、正文和 canonical。其他标记收录与摘要限制、已有 JSON-LD 的语法以及图片 alt 属性。看完后可以通过「JSON report」下载完整结果。即使页面只筛选出三项下载文件也会保留全部检查方便后续排查或交给一起维护网站的人。分数可以参考重点还是下面的检查项截图中的 86 分来自工具自己的评分规则用来汇总本次检查。它不是搜索排名分数也不能说明页面已经被收录。报告还会显示覆盖率有些项目如果拿不到证据就标成未知降低覆盖率而不是直接判错。noindex 等阻断项会单独提示避免被一个看起来不错的总分掩盖。想了解具体算法可以看仓库里的评分说明。使用前留意这几点Crawlmark 一次检查一个页面的初始响应不做整站扫描也不查询收录情况、外链或页面性能。对于大量依赖 JavaScript 的网页需要再结合渲染后的页面检查。它更适合帮你发现基础设置上的遗漏而不是回答“为什么网站没排名”。在线版会把你输入的网址发送到检测服务所以只提交公开页面不要放入带密码、密钥或签名参数的私密链接。演示服务使用免费实例闲置后第一次检测可能要等约一分钟如果提示限流稍后再试即可。经常使用的话也可以按部署说明自己搭一套。如果你刚上线了一个网站可以拿首页或一篇文章试试。碰到判断不准确的地方欢迎附上不含敏感信息的例子提 issue。觉得用得上也欢迎到 GitHub 仓库 点个 star留着下次检查时用。