Google 抓取限制检查器

Googlebot 在 2MB 后停止解析 HTML。检查您的页面是否超出此限制并确定哪些页面占用的空间最多。

我们将分析 Googlebot 看到的原始 HTML 大小。每行输入一个 URL 以进行批量分析。

关于此工具

Googlebot 在抓取网页时存在技术限制:它会在 2MB(2,097,152 字节)后停止解析 HTML。这意味着,如果您网页的 HTML 超过此限制,Google 不会将您的部分内容编入索引,从而可能会影响您的 SEO 性能。

它是如何运作的

  1. 获取 Googlebot 看到的页面 HTML(在 JavaScript 执行之前)
  2. 使用 UTF-8 编码计算准确的字节大小
  3. 分析哪些内容消耗空间:内联脚本、样式、base64 图像、SVG 图形等。
  4. 使用特定 CSS 选择器识别前 10 个最大的 HTML 元素
  5. 生成按优先级排列的可行建议
  6. 显示不计入限制的外部资源(脚本、CSS、图像)

什么算作 2MB 限制?

计数达到极限

  • • 内联 JavaScript(没有 src 的脚本标签)
  • • 内联 CSS(样式标签和样式属性)
  • • HTML/CSS 中的 Base64 编码图像
  • • 内嵌 SVG 图形
  • • 所有文本内容和 HTML 结构
  • • HTML 注释和空格

不算数

  • • 外部 JavaScript 文件(脚本 src="...")
  • • 外部 CSS 文件(链接 rel="stylesheet")
  • • 外部图像 (img src="...")
  • • 外部字体、视频和其他媒体
  • • 通过 AJAX/fetch 加载内容
  • • JavaScript 呈现的内容

专业提示: 保持在限制范围内的最佳方法是将大型内联脚本和样式外部化到单独的 .js 和 .css 文件中。这也提高了缓存和页面加载性能!

常见问题解答