いつもお世話になっております。Qlipper運営・株式会社トドオナダです。
「広報のためのLLMO Tips」第15回をお届けいたします。
────────────────────────
「Common Crawlに巡回された」ことと「自社サイト全体が採録された」ことは、まったく別です。
今日は、クローラーの構造的な制限を見ます。
ここを知ると、自社の記事がなぜAIに届かないのかが具体的に分かります。
Common Crawlのクローラーには、リンクをたどる深さに厳しい制限があります。
無限に生成されるURLの罠を避け、効率化するため、起点となるトップページから最大3リンク先までしかたどりません。
具体的には、トップページが0ホップ、そこからリンクされたカテゴリページが1ホップ、記事一覧が2ホップ、個別記事が3ホップ。
この4層目で打ち止めです。
トップから4リンク以上たどった深い階層のページは、通常のクロールでは採録されません。
ここに落とし穴があります。
自社サイトが大きく育ち、記事が階層的に整理されているほど、深い階層の記事はかえって届きにくくなるのです。
カテゴリ、サブカテゴリ、年別、月別、記事という一般的な構造では、記事本文はトップから4〜5ホップ先にあります。
この構造では、肝心の記事本文がCommon Crawlに届きません。
回避策はあります。
Common Crawlはsitemap.xml(サイトマップ)を活用し、そこに載っているURLはリンクをたどる必要がないため「起点」として直接キューに登録されます。
深い階層の記事も、サイトマップに載っていれば階層の壁を越えられます。
逆に言えば、サイトマップに載っていない深い階層のページは、届かない可能性が高いということです。
自社の記事URLがサイトマップに含まれているかは、今日確認できます。
そして、その確認と並行してやるべきは、実際にAIに聞いてみることです。
もしAIが自社の個別の取り組みを語れるなら、記事本文はどこかの経路で届いている。
トップページの会社概要レベルしか語れないなら、深い階層の記事が切り捨てられている疑いがあります。
届いているか止まっているか、AIの答えがヒントをくれます。
────────────────────────
ここまでお読みいただいて、一つはっきりすることがあります。
「AIが今、自社をどう認識しているか」を推測ではなく事実として見ない限り、次の一手は決められない、ということです。
それができるのが、Qlipper上のLLM認知確認ツール「ディギディギ」です。
◆ ディギディギならできること
「掲載されたのにAIに効いていない」記事を、1本ずつ分解して原因を特定します。
そもそもAIの学習元(Common Crawlという巨大Webアーカイブ)に届く経路にあるか、自社名と文脈がその記事内で共起しているか、フィルタで落ちる要素を含んでいないか。
掲載して終わりではなく、なぜ効かなかったかまで踏み込みます。
深い階層で切り捨てられている記事の問題も、ここで見えてきます。
────────────────────────
▼ 御社のブランドで、実際に測ってみませんか
AIが自社を今どう語っているか、その場で確認できます(所要30分)。
▼ まずは資料で確かめたい方へ
「広報のためのLLMO対策」実践ガイドを配布中です。
────────────────────────
次回もどうぞお楽しみに。
何かご不明点がございましたら、お気軽にご連絡ください。
どうぞよろしくお願いいたします。
===============================
===============================
株式会社トドオナダ
Qlipper運営事務局
〒110-0005
東京都台東区上野7-11-13 弥彦ビル302
03-6453-6886
info@todo-o-nada.com
https://qlipper.jp/
===============================
