Google クロール制限チェッカー
Googlebot は 2MB を超えると HTML の解析を停止します。ページがこの制限を超えているかどうかを確認し、最も多くのスペースを消費しているものを特定します。
このツールについて
Googlebot には、Web ページをクロールする際の技術的な制限があります。つまり、2MB (2,097,152 バイト) を超えると HTML の解析が停止されます。つまり、ページの HTML がこの制限を超えると、コンテンツの一部が Google によってインデックスに登録されなくなり、SEO のパフォーマンスに影響を与える可能性があります。
仕組み
- Googlebot が認識したとおりにページの HTML を取得します(JavaScript の実行前)。
- UTF-8エンコーディングを使用して正確なバイトサイズを計算します。
- インラインスクリプト、スタイル、base64画像、SVGグラフィックスなど、スペースを消費しているものを分析します。
- 特定の CSS セレクターを使用して上位 10 個の最大の HTML 要素を特定します
- 優先順位に従ってランク付けされた実用的な推奨事項を生成します
- 制限にカウントされない外部リソース (スクリプト、CSS、画像) を表示します
2MB の制限には何が考慮されますか?
限界に向けてカウントする
- • インライン JavaScript (src のないスクリプト タグ)
- • インラインCSS(スタイルタグとスタイル属性)
- • HTML/CSS の Base64 エンコード画像
- • インラインSVGグラフィックス
- • すべてのテキストコンテンツとHTML構造
- • HTML コメントと空白
カウントされません
- • 外部 JavaScript ファイル (script src="...")
- • 外部 CSS ファイル (リンク rel="stylesheet")
- • 外部画像 (img src="...")
- • 外部フォント、ビデオ、その他のメディア
- • AJAX/フェッチ経由でロードされたコンテンツ
- • JavaScript によってレンダリングされるコンテンツ
プロのヒント: 制限を下回る最善の方法は、大規模なインライン スクリプトとスタイルを個別の .js および .css ファイルに外部化することです。これにより、キャッシュとページ読み込みのパフォーマンスも向上します。
よくある質問
Google は、非常に大きな HTML ファイルがクロール中に過剰なリソースを消費するのを防ぐために、この制限を導入しました。 2MB を超えるページはまれで、通常は最適化の機会を示します。 Googlebot は引き続き最初の 2MB のインデックスを作成しますが、それ以降のコンテンツはインデックスに登録されない可能性があります。
Googlebot は 2MB を超えると HTML の解析を停止します。つまり、それ以降の重要なコンテンツ、リンク、構造化データは表示されず、インデックスも作成されなくなります。これは SEO に大きな影響を与える可能性があります。このツールはスペースを消費しているものを特定するので、それに応じて最適化できます。
いや! URL 経由でロードされた外部 JavaScript ファイル、CSS スタイルシート、画像は、2MB の HTML 制限にはカウントされません。生の HTML コンテンツ自体のみがカウントされます。これが、インライン スクリプトとスタイルを外部化することが効果的な最適化戦略である理由です。
とても正確です!このツールは、Googlebot が認識したとおりにページを取得し、UTF-8 エンコード (Google が使用しているのと同じ方法) を使用して生の HTML サイズを計算します。 JavaScript の実行前に HTML を分析し、Google の初期クロール動作と一致させます。
ツールによって提供される推奨事項に従ってください: インライン JavaScript と CSS の外部化、base64 画像のファイルへの変換、大きな SVG の最適化または削除、HTML コメントの削除、HTML の縮小。これらの最適化により、ページ読み込みパフォーマンスも向上します。
はい!ページを分析した後、HTML サイズ、カテゴリ別の内訳、スペースの上位消費者、推奨事項を含むすべての結果を CSV 形式にエクスポートできます。これは、時間の経過とともに進捗状況を追跡したり、開発チームと共有したりする場合に役立ちます。
reCAPTCHA は、自動化された悪用を防止し、ツールが実際のユーザーによって使用されるようにするのに役立ちます。 Web ページの取得と分析にはサーバー リソースが必要なため、この保護によりすべてのユーザーに対するサービス品質が維持されます。