マーケティングエンジニアのためのテクニカルGEO:robots.txt・構造化データ・llms.txt
テクニカルGEOでは、
マーケティングエンジニアの担当範囲
コンテンツの
1. AIクローラーを受け入れる
ボットの用途を区別する
ベンダーの
- 検索・インデックス:OAI-SearchBotは
ChatGPT Search、 Claude-SearchBotは Claudeの 検索、 Googlebotは Google検索と AI Overviews・AI Modeを 支えます。 PerplexityBotも 検索・取得用です。 - ユーザー起点の
取得 :ChatGPT-UserとClaude-Userは、 ユーザーの 操作に 応じて ページを 取得します。 OpenAIは、 ChatGPT-Userを 検索掲載の 判定には 使わないと 明記しています。 - 学習・モデル開発:GPTBotと
ClaudeBotは、 モデル学習に 使われる 可能性が ある 公開ウェブ情報を 収集します。 各社の 検索掲載を 制御する ボットとは 別です。
OtterlyAIはrobots.txt、
# 検索・インデックス:対象にしたいサービスを許可
User-agent: OAI-SearchBot
Allow: /
User-agent: Claude-SearchBot
Allow: /
User-agent: PerplexityBot
Allow: /
User-agent: Googlebot
Allow: /
# ユーザー起点の取得:検索掲載とは別に判断
User-agent: ChatGPT-User
Allow: /
User-agent: Claude-User
Allow: /
# 学習・モデル開発:別のポリシーとして判断
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
上記は
CDNやrobots.txtで
Google検索の
JavaScriptに依存しないHTML
Vercelの
検証は
curl -A "OAI-SearchBot" https://example.com/page/ | grep "重要なテキスト"
初期HTMLに
2. 構造化データ:タグより事実を重視
まず、
一方、
- 実データを
載せた :価格、Product/SoftwareApplication+Offer 評価、 仕様を 含むProduct/Reviewスキーマの ページは、 ある クロスプラットフォーム観察研究で 61.7%が 引用され、 汎用スキーマ型は 41.6%でした。 低オーソリティの ドメインで 関連が 強い 結果でしたが、 schemaを 追加した ことが差を 生んだとは 証明していません。 別の 統制研究では、 明示的な 価格が 引用候補を 絞る 要素の 一つでした。 タグに よる 引用増加を 約束せず、 正確な 価格・評価・仕様を 表示本文にも 掲載します。 - Organization:社名、
所在地、 公式プロフィールへの sameAsを一貫させ、 企業情報の 基準点と して 使います。 マークアップ自体に よる 引用増加は 約束できません。 - FAQPage:Q&A形式や
schemaの ラッパーだけでは 不十分です。 各回答が 利用者の 問いに 明確に 答え、 必要な 数値、 定義、 比較、 出典を 含むかを 優先します。 - Article+Person:著者と
日付を 表示内容と 一致させます。 Googleは E-E-A-Tを 直接の ランキング要因とは 位置付けて おらず、 特に YMYLでは 信頼性を 判断する ための 考え方と して 扱っています。
実装後はリッチリザルトテストと
3. llms.txt:任意の補助ファイル
llms.txtが
自動生成できる
手作業で
検証チェックリスト
robots.txtで、検索用、 ユーザー起点、 学習用の 用途を 区別して 設定している - WAF/CDNが
AIクローラーの User-Agentに 403を 返していない (アクセスログで 確認) - 直接取得した
初期HTMLに 重要な 本文が 含まれる - 製品ページに
価格・ 仕様の 実データを 載せた Product/Offerスキーマが あり、 Organizationスキーマに sameAsリンクがある - llms.txtを
公開する 場合は ビルド時に 自動生成している (任意の 補助ファイルであり、 引用要因ではない) - サーバーログの
AIクローラー訪問を 公式IPレンジと 照合し、 定期確認している
技術基盤を
参照した
出典
- OpenAI「Overview of OpenAI Crawlers」
- Anthropic Help Center「Does Anthropic crawl data from the web?」
- Vercel「The rise of the AI crawler」
- Google検索セントラル
「AI Features and Your Website」 - Google検索セントラル
「Googleの 一般的な クローラー」 - ナイル/SEO HACKS
「SEO・LLMOトピックスvol.9」 - Search Engine Land「Google says normal SEO works … and LLMS.txt won’t be used」
- Ahrefs「We Tracked 1,885 Pages Adding Schema. AI Citations Barely Moved.」
- Vishwakarma et al.
(Sprinklr) 「What Gets Cited: Competitive GEO in AI Answer Engines」 (SIGIR ‘26) - OtterlyAI「The AI Citation Economy: 1+ Million Data Points」
- 「Does Schema Markup Predict AI Citation?」
(構造化データの 観察研究)