CRAWLER POLICY / TRANSPARENCY

User-Agent:QUERYA-Audit/0.1

何を取りに行き、
何を取りに行かないか。

QUERYA CHECKの無料診断は、利用者がURLを送信した時だけ動くユーザー操作型の取得です。自動巡回やログイン突破は行いません。

AT A GLANCE

公開ページ1URLを、
必要な範囲だけ。

現在の無料版は全ページ巡回を行わず、入力された1URLと同一ホストの補助ファイルを、利用者が診断を実行した1回だけ取得します。バックグラウンド巡回や定期アクセスは行いません。

1

入力ページ

公開HTMLを最大約1.5MBまで取得

2

補助ファイル

robots.txt・llms.txtを各最大約120KBまで

12

秒

1回の接続タイムアウト目安

4

回

リダイレクト追跡の上限

BEHAVIOR

取得するもの・
対象外にするもの。

取得・確認する

  • 利用者が入力したhttp / httpsの公開URL
  • 同一ホストのrobots.txt・llms.txt
  • HTTPステータス、応答ヘッダー、転送先
  • サーバーから返された公開HTML内のmeta・見出し・リンク・画像等

取得しない・受け付けない

  • ログインや認証が必要な非公開ページ
  • localhost、社内ネットワーク、予約済みIP帯
  • 認証情報を含むURL、標準外ポート
  • JavaScriptの実行、サイト全体の自動巡回、フォーム送信、ファイル変更
HTTP USER-AGENTQUERYA-Audit/0.1

対象サイトのアクセスログでは、この識別子が記録される場合があります。バージョン番号は診断機能の更新に伴い変わることがあります。

アクセス頻度

1回の診断操作につき、入力URL・robots.txt・llms.txtを各1回の診断シーケンスで取得します。転送時は各URLにつき最大4回まで追跡し、診断後の自動再取得は行いません。

取得内容の保持

HTML・robots.txt・llms.txtそのものは保存しません。共有に必要な診断結果だけを7日間保存し、実行したブラウザから期間内でも無効化できます。

ROBOTS.TXT

robots.txtは、
診断対象でもあります。

robots.txtはGooglebotやAIクローラー向け設定を評価するために取得します。現在のQUERYA-Audit自体の取得可否にはAllow・Disallowを適用せず、利用者が確認権限を持つ公開URLだけを診断対象とします。

入力URL→robots.txtを確認→各クローラー設定を評価→結果へ表示

アクセス制御を迂回しません

robots.txtは認証やアクセス制御の代替ではありません。QUERYA CHECKは認証、非公開ネットワーク、標準外ポートなどへの接続を受け付けず、対象サイトがHTTP 401・403等を返した場合も制限を突破せず取得失敗として扱います。

Robots Exclusion Protocol(RFC 9309)(新しいタブで開きます)

QUESTIONS & REQUESTS

アクセスについて、
確認したいとき。

株式会社ファーストイノベーション

QUERYA CHECKからのアクセスと思われる記録や、取得方針について確認したい場合は、対象URL・日時・User-Agent・ログの識別情報を添えて運営会社へご連絡ください。

公式窓口へ相談(新しいタブで開きます)

NEXT STEP

公開情報の範囲で、サイトを確認。

診断対象は、ご自身が管理する、または確認権限を持つ公開URLに限ってご利用ください。