LLMO Audit

LLMO診断|生成AI検索の言及・引用・正確性を回答ログ付きで調査

顧客の課題から候補に入るか、公式情報が引用されるか、説明が正確かを同じ条件で調査します。質問数、対象AI、反復、成果物、検収条件、対応外を標準設計例として公開しています。

サービス情報・標準設計例の確認日:

Scope

スコアだけではなく、回答と根拠を残します。

一度の回答や総合点だけでは、改善すべき原因を判断できません。質問の意図、 対象AI、日時、回答、引用元、競合言及を記録し、繰り返し現れる傾向と偶然を分けます。

そのうえで、クロール・構造・公式情報・一次情報・外部情報のどこに不足や不一致があるかを整理します。

Decision boundary

診断で分かることと、
分からないこと。

観測した回答と公開根拠から判断できる範囲を明示し、 AIの内部状態や将来の掲載を推測で補いません。

CAN

回答ログから判断できること

  • どの質問・比較条件で自社やサービスが言及されたか
  • 公式サイトや一次情報が回答の根拠として引用されたか
  • 対象顧客、機能、価格、会社情報などの説明が確認済み事実と一致するか
  • 競合がどの文脈で候補となり、自社との情報差がどこにあるか
  • 技術、内容、一次情報、外部情報のどこから改善するか
CANNOT

診断だけでは判断できないこと

  • 生成AIが回答を選んだ内部の思考過程や学習データの特定
  • 将来の検索順位、AI回答への掲載・引用、流入、問い合わせの保証
  • すべての利用者、地域、言語、時点で同じ回答が返るという断定
  • 観測していないAI、質問、モデル、検索条件での結果
  • 一回の観測だけを根拠にした長期傾向や施策効果の断定

Standard design example

20問×最大3 AI×3回。
調査単位を先にそろえます。

最大180試行は固定料金・納期・契約範囲ではなく、見積もり前に調査の粒度を比較するための標準設計例です。

1

ブランド/サービス

一つの事業単位と、優先20 URLまでを対象にします。

20

質問

認知・比較・導入・事実確認の4群×各5問を標準例とします。

最大3

AIサービス

顧客利用、検索機能、地域・言語を確認して合意します。

3

反復

同じ版の質問を繰り返し、一度きりの回答と傾向を分けます。

Scope details

含まれる単位と、含まれない範囲。

最終範囲は、対象、利用可能なAI、地域・言語、公開情報の量を確認し、 見積書・契約書で合意します。下表は相談前の比較に使う設計例です。

対象1ブランドまたは1サービス
公式サイトと、相談時に合意した主要サービスを一つの診断単位にします。
境界:複数ブランド、複数事業、海外市場は別範囲として設計します。
公開ページ優先20 URLまで
会社、サービス、比較、料金、事例、問い合わせなど意思決定に近い公開URLを優先します。
境界:サイト全体の網羅クロールやログイン後ページは含みません。
比較対象競合3社まで
依頼者指定または回答内で繰り返し現れる比較候補を、同じ質問条件で観測します。
境界:市場シェア、売上、導入社数など公開根拠がない比較は行いません。
質問設計20問
認知、比較、導入、事実確認の4群に分け、各5問を標準例とします。
境界:指名質問だけで掲載率を算出せず、質問群ごとに分けて報告します。
対象AI最大3サービス
ChatGPT、Gemini、Perplexityなどから、検索機能と顧客利用状況を踏まえて合意します。
境界:全モデル、全プラン、全ユーザー条件の再現は保証しません。
反復各質問・各AIを3回
同じ版の質問を反復し、一回だけの回答と繰り返し現れる傾向を分けます。
境界:回答不能、拒否、障害は削除せず、別区分で分母とともに残します。
観測単位最大180試行
20問×最大3 AI×3回の標準例です。質問、AI、反復ごとに一行のログを残します。
境界:契約前の見積もりではなく、最終件数は対象と利用条件に応じて合意します。
地域・言語日本・日本語
地域、言語、検索機能、観測日、利用画面を記録します。
境界:多言語、海外地域、位置依存の比較は別の調査設計が必要です。

Metrics

診断で確認する4つの基本指標。

01

言及率

非指名の質問を含め、自社・ブランド・サービスが回答に登場した割合。

02

公式引用率

公式サイトや一次資料が、回答の根拠として示された割合。

03

正確性

対象顧客、機能、価格、会社情報などの主要事実が正しく説明された割合。

04

推奨文脈

どの課題や比較条件で候補となり、選定理由がどう説明されたか。

Process

診断から改善計画まで。

  1. 01
    Discovery

    事業理解

    対象顧客、サービス、比較対象、問い合わせにつながる重要な意思決定を確認します。

  2. 02
    Query design

    質問設計

    認知・比較・導入・事実確認の質問を分け、指名質問だけに偏らない調査票を作ります。

  3. 03
    Observation

    複数回観測

    回答、引用元、競合言及、説明の正確性を、条件とともに記録します。

  4. 04
    Diagnosis

    原因診断

    技術、内容、一次情報、外部情報に分け、見えない・誤る原因を整理します。

  5. 05
    Roadmap

    改善計画

    事業影響と実行難易度から、短期・中期の改善順序を提示します。

Deliverables

社内で使える、
検証可能な成果物。

01

質問・回答・引用ログ

質問ID、意図、AI、日時、条件、回答、引用URL、競合言及、実行状態

受け入れ条件:計画試行数、完了数、失敗数が一致し、失敗試行を除外せず理由とともに確認できる

02

可視性ベースライン

質問群別の言及率、候補掲載率、公式引用率、重要事実の正確性、回答不能率

受け入れ条件:各指標に分子、分母、対象質問、採用・除外条件があり、元ログから再計算できる

03

競合・引用元ギャップ

候補になった競合、表示された引用元、公式・第三者・不明の区分、自社との差

受け入れ条件:観測事実と推測を分け、比較ごとに回答または参照URLへ戻れる

04

原因・機会マップ

検索基盤、公式情報、一次情報、第三者情報、計測の5分類と確認根拠

受け入れ条件:各課題に対象URL、根拠、影響する質問群、確認できない事項が記録されている

05

90日改善計画

優先順位、対象、担当候補、受け入れ条件、証拠、再計測条件、依存関係

受け入れ条件:各項目が実行可能な単位で、完了条件と再計測方法を第三者が確認できる

成果物の出典、判定、AI利用、訂正方法は編集・調査ポリシーに基づきます。

Client inputs

最初に必要なのは、公開URLと対象サービスです。

対象顧客、重要質問、競合、誤ると困る事実は、分かる範囲で構いません。 初回フォームへ機密情報、顧客データ、パスワード、APIキーを送らないでください。

公式サイトURL
必須
会社または対象サービスの公開URL
送らないもの:管理画面URL、ログイン情報、未公開URL
対象サービス
必須
誰の、どの課題を、どう解決するサービスか
送らないもの:未公開の顧客名や契約書本文
対象顧客
必須
業種、役割、検討段階、地域
送らないもの:個人を特定できる見込み顧客情報
重要な質問
任意
候補になりたい質問を3つまで
送らないもの:個人情報、営業秘密を含む実際の会話ログ
比較対象
任意
競合または代替手段を3つまで
送らないもの:未公表の競合調査、第三者の秘密情報
重要事実
任意
対象顧客、機能、提供地域、公開料金など誤ると困る事実
送らないもの:未公開料金、個別契約条件、個人情報
現在の施策
任意
SEO、広報、構造化データ、コンテンツの公開状況
送らないもの:アクセス権、APIキー、パスワード

Boundary

診断に含めないことと、
診断後の選択肢。

診断結果をレポートで止めず、誰が次に何をするかを選べる状態まで整理します。 ただし、実装と継続監視は標準診断例に含めません。

OUT

標準診断例に含めないこと

  • サイト改修、記事制作、外部媒体への掲載交渉などの実装作業
  • 管理画面、社内文書、顧客データなど非公開情報の監査
  • 法務、医療、金融、セキュリティの専門判断
  • 検索順位、インデックス登録、生成AI回答への掲載・引用の保証
  • 継続監視と施策後の再計測
01

診断で区切る

基準線と優先度つき改善計画を社内または既存支援会社へ引き渡します。

02

改善範囲を切り出す

技術、公式情報、一次情報、計測から、合意した項目だけを別途実装します。

03

同じ条件で再計測する

質問版、AI、地域、言語、反復条件を固定し、施策前後の変化を判定します。

Start with scope

診断だけで十分か、改善まで必要かを先に切り分けます。

公式サイトURL、対象サービス、対象顧客を送ってください。 初回相談で、標準設計例から増減する範囲、成果物、受け入れ条件、対応外を確認します。

Before you ask

費用は、調査範囲と成果物を分けて比較してください。

自動ツールのスコア、専門家による単発診断、技術実装、継続コンサルティングでは、 同じ「LLMO診断」でも内容が異なります。公開料金を調べた記事で、比較時の確認項目をまとめています。

FAQ

診断について

調査範囲と結果の扱いについて回答します。

Q1LLMO診断では、どの生成AIを調査しますか?
A

事業と顧客の利用状況に応じて対象を決めます。ChatGPT、Gemini、Perplexityなどを候補とし、検索機能の有無、地域、日時、質問文を記録します。

Q2診断だけを依頼できますか?
A

可能です。現状把握と優先度つき改善計画までを一つの区切りにできます。技術実装、コンテンツ制作、再計測は必要な範囲だけ切り分けます。

Q3何件の質問を調査しますか?
A

一律の件数ではなく、認知・比較・導入・事実確認に必要な質問を設計します。相談時に事業と対象顧客を確認し、調査範囲を明示します。

Q4診断結果は順位を保証するものですか?
A

いいえ。診断は、特定時点の回答と引用を観測し、改善可能な原因を見つけるものです。掲載・引用・検索順位の保証は行いません。

Q520問・最大3 AI・各3回は、必ず同じ件数で提供されますか?
A

固定の契約条件ではなく、調査単位を比較しやすくする標準設計例です。対象顧客、サービス、利用できるAI、地域、言語を確認し、最終件数と成果物を見積書・契約書で合意します。

Q6相談前に何を準備すればよいですか?
A

公式サイトURL、対象サービス、対象顧客があれば開始できます。候補になりたい質問、比較対象、誤ると困る重要事実は任意です。分からない項目は初回相談で整理します。

Q7機密資料や管理画面の共有は必要ですか?
A

標準診断例は公開情報を対象とし、初回フォームへ機密情報、顧客データ、パスワード、APIキーを送る必要はありません。非公開情報が必要な場合は、目的、範囲、保存、削除条件を別途合意します。

Q8診断後のサイト改修や記事制作も含まれますか?
A

標準診断例には含みません。診断結果を社内や既存支援会社へ引き渡す、必要な改善だけを別途切り出す、同じ条件で再計測する、の三つから選べます。

Contact

選ばれない理由を特定し、
次の90日を決める。

無料相談で、対象AI、候補になりたい質問、診断範囲と次の一歩を整理します。 公式サイトURLだけでも始められます。

無料相談で診断範囲を整理する