本文へスキップ
← ブログ

ブログ

ECカートの標準設定は、AIのクローラを1種類も名指ししていなかった(6社を実測)

AIに読ませるか読ませないかを、店主が決められる状態になっているのか。気になったので、各社が自分で出している店を測ってみました。

公開 robots-txtai-crawlerecllms-txt

結論から書くと、店の標準設定では AI のクローラは1種類も名指しされていません。許可も拒否も書かれていない。つまり、店主が何もしなければ全部読まれます。学習にも、AI検索の引用にも。

測り方はこうです。当社の Tier 0 診断(登録もメールも不要・公開ページだけを読む)に URL を入れて、robots.txt が AI のクローラ8種(GPTBot・OAI-SearchBot・ChatGPT-User・ClaudeBot・Claude-User・PerplexityBot・Google-Extended・Applebot-Extended)をどう扱っているかを見ました。測ったのは2026年9月21日。対象は各社が自分で公開している公式ストア・公式デモストア・本体サイトの6ホストだけで、どこかの店舗さんのサイトは1件も測っていません。

6ホストの結果

測った面AIクローラ8種の扱いllms.txtsitemap
official.base.shop(BASE 公式ストア)1種も名指しなし(* に従って読める)取得できず取得できず
shop.stores.jp(STORES 公式ストア)1種も名指しなしなし取得できず
demo.shop-pro.jp(カラーミー デモストア)1種も名指しなしなしなし
hydrogen.shop(Shopify 公式デモ)1種も名指しなしなしあり
www.makeshop.jp(MakeShop 本体サイト)GPTBot・ClaudeBot・Google-Extended・Applebot-Extended を名指しで拒否。残り4種は通すなしあり
www.future-shop.co.jp(futureshop 本体サイト)1種も名指しなしなしあり

「取得できず」は「なし」ではありません。BASE の公式ストアはレート制限(429)で弾かれ、STORES の公式ストアの sitemap.xml は 403 でした。どちらも置いていないとは書けないので、そのまま「取得できず」と残しています。カラーミーのデモストアはページ本体が err.shop-pro.jp/403.htm へ飛ぶので、根拠にしたのは robots.txt の読みだけです。futureshop は co.jp から future-shop.jp へ転送されるので、読んだのは転送先の robots.txt です。

SEOボットは名指しで断っている。AIだけ書かれていない

SEO系のクローラは違います。STORES の公式ストアは MJ12bot と Amazonbot を名指しで拒否していますし、カラーミーのデモストアは AhrefsBot・SemrushBot・PetalBot など8種を拒否しています。名指しで断る運用そのものは、すでに動いている。

にもかかわらず、今回見た8種は1つも書かれていません(Amazonbot を AI 側に数える立場もあり、STORES はそれを拒否しています)。これは見落としというより、リストがまだ更新されていないのだと思います。SEOボットの拒否リストは何年もかけて溜まってきたもので、GPTBot が公開されたのは2023年8月です(OpenAI の GPTBot ドキュメント)。

では店主が自分で書き換えられるかというと、ここはカートによって違いました。Shopify はテーマに robots.txt.liquid というファイルを足せば、既定の規則に自分の規則を足せます(Shopify 開発者ドキュメント)。残りの4社(BASE・STORES・カラーミー・futureshop)について店主が編集できるかは、今回は確かめられていません。ヘルプページが自動アクセスを弾く面もあり、ここは【未確認】のままにしておきます。

「学習は断る、引用は通す」を実装している例が1つあった

6ホストで唯一、AI のクローラを名指ししていたのが MakeShop 本体サイトの robots.txt でした。店舗の標準設定ではなく、同社のコーポレート/サービスサイトの設定です。

中身は、学習用のクローラ(GPTBot・ClaudeBot・Google-Extended・Applebot-Extended など)を拒否して、AI検索から引用しに来るクローラ(OAI-SearchBot・ChatGPT-User・Claude-User・PerplexityBot)は通す、という分け方。ファイルには日本語のコメントで方針と最終更新日まで書かれていました。

この分け方が正解だと言うつもりはありません。ただ、「AI に読ませたくない」と「AI 検索で見つけてほしい」は両立する要求で、robots.txt のレベルでは分けて書けるというのは、実例を見るまで自分もぴんと来ていませんでした。

llms.txt は、読めた5件すべてで「なし」

ついでに llms.txt(サイトの中身を AI 向けに要約して置いておくファイル)も見ました。取得できた5件はすべて「なし」。残り1件は取得そのものに失敗しているので、置いていないとは書きません。

これは各社が判断して置いていないというより、まだ誰も置いていない段階、という読み方をしています。当社のサイトには置いていますが、それで問い合わせが増えたという実感はまだありません。

自分の店を測る

同じ検査は、このページの下にある入力欄に URL を入れれば、その場で走ります。登録もメールも要りません。読むのは公開されているページ(robots.txt・llms.txt・sitemap.xml・そのページ自体)だけで、買い物の経路は歩きません。結果は共有できる URL になるので、制作会社さんやカートのサポート窓口にそのまま貼れます。

結果を見て「読まれたくないものが読まれている」となったら、次は自分のカートで robots.txt を書き換えられるかを調べる番です。Shopify なら自分で足せます。それ以外は、結果の URL をそのままサポート窓口に貼って聞くのが早いと思います。

書き換えたあと、本当に止まっているかの確かめ方と、止めたつもりで止まっていない書き方はrobots.txt で GPTBot を止めているか確かめる方法にまとめました。

自分のサイトでも試す

URLを入れると、その場で分かります。AIのクローラが入れるか、AI向けの案内ファイルがあるか、検索に出さない指定が付いていないかを、公開されているページだけで確かめます。