ChatGPTが会社のことを答えるとき、多くはその場でウェブを検索し、見つかったページをまとめて答えています。 だから、自社サイトより先に見つかる「古くて量の多い第三者の記事」が、そのまま答えになりがちです。 直すには、自社サイトを整えるだけでは足りません。第三者の側にある古い情報を新しくし、新しい出典を増やす必要があります。 この記事では、その仕組みと直す順番を、各社の公式の説明をもとに整理します。
会社のことをAIに聞くと、たとえば次のような答えが返ってくることがあります。
どれも、AIが嘘をついているわけではありません。見つけた資料が古いか、別の意味の日付を取り違えているのです。以下で、なぜそうなるのかを順に見ていきます。
OpenAIのヘルプによると、ChatGPTは「最新の情報が役立つ質問」のとき、自動でウェブを検索することがあります。検索の際は、質問を1つ以上の検索語に書き換えて、提携する検索事業者に送ります。提携先としてMicrosoftなどの名前が挙がっています。検索を使った答えには、出典(引用元のリンク)が付くことがあります。
同じヘルプには「検索結果や引用は不完全だったり、古かったり、誤っていたりすることがある」とも書かれています。OpenAI自身が、古い出典を引くことがあると認めているわけです。
ここで大事なのは、ChatGPTが「インターネット全体を読んでいる」わけではないことです。検索で見つかったページの中から選んでいます。
公開して日が浅いサイトは、検索事業者の索引(検索エンジンが持つページの一覧)にまだ十分に入っていないことがあります。また、OpenAIの検索用クローラー(ページを集めて回るプログラム)「OAI-SearchBot」をサイト側で拒否していると、検索結果に載る対象になりません。OpenAIは、許可していても「掲載されるとは限らない」としています。
「公開から日が浅い」「会社名で検索すると、古い第三者のページのほうが多い」という条件がそろうと、自社サイトは出典に出にくくなります。
Googleの「AIによる概要」と「AIモード」も、仕組みの土台は検索です。Google検索セントラルの説明では、関連する複数の検索を同時に行う「クエリ ファンアウト」という方法で答えを組み立てます。答えの中にリンクとして表示されるには、そのページがGoogleにインデックス(登録)され、スニペット付きで検索結果に出られる状態である必要があります。
一方でGoogleは、AIの機能に表示されるための特別な対策は要らない、とも書いています。AI専用のファイルや新しいマークアップを作る必要もないそうです。やるべきことは、通常の検索に向けた基本と同じです。
上の仕組みから考えると、間違いには「よく出る形」があります。会社の情報で起きやすいものを表にまとめました。
| 間違えやすい項目 | よくある間違い方 | 原因になりやすい出典 |
|---|---|---|
| 事業内容 | 昔の事業を今の事業として、または今の会社を「過去の会社」として説明する | 数年前のプレスリリース、開店・新商品のニュース |
| 設立日 | 法人番号の指定日など、別の日付を設立日として答える | 法人データを転載した企業情報サイト |
| 所在地 | 移転前の住所を答える | 古い求人ページ、移転前の取材記事 |
| 代表者 | 前の代表者の名前を答える | 過去のインタビュー記事、古い会社紹介 |
| 会社の同定 | 似た名前の別会社と混ぜる | 社名だけで照合された企業データベース |
| 事業の現状 | 撤退した事業が続いているように答える | 閉じたあとも残っている求人・店舗情報 |
設立日がずれやすいのは、日付が2種類あるからです。
国税庁の法人番号公表サイトには「法人番号指定年月日」という項目があります。国税庁はこれを「国税庁長官が法人番号を指定した年月日」と説明しています。会社が成立した日ではありません。法人番号は設立の登記が終わったあとに指定されるため、設立日より後の日付になることがあります。
法人番号のデータは誰でも使えるため、多くの企業情報サイトに転載されています。その中で「指定日」が「設立日」のように扱われると、AIはそれを設立日として拾います。
もう一つの特徴は、古い第三者の記事が「量」で勝つことです。プレスリリースは配信先に転載され、求人は複数のサイトに載ります。一方、自社サイトは1つだけです。会社が事業を変えても、昔の記事は書き換わりません。検索で見つかる量が多いほど、AIの答えはそちらに引っ張られます。
順番には理由があります。先に「正しい情報の置き場所」を作り、次に「間違いの元」を減らし、最後に測り直します。
まず、自社サイトに会社概要のページを置きます。社名、所在地、設立日(登記上の成立日)、代表者、事業内容、法人番号を、文字で書きます。画像の中の文字だけにしないでください。
次に、構造化データ(検索エンジンに会社の情報を機械が読める形で伝える書き方)を入れます。Googleは、トップページに「Organization(組織)」の構造化データを入れると、組織の情報を理解しやすくなり、検索結果で他の組織と区別しやすくなると説明しています。推奨される項目には、name(名称)、url、logo、address(住所)、foundingDate(設立日)、legalName(正式名称)、sameAs(会社の情報が載った他サイトのURL)、taxID などがあります。
ここで2つ注意があります。
あわせて、robots.txt(クローラーに読んでよい範囲を伝えるファイル)で、GoogleやOAI-SearchBotを拒否していないかも確認します。
公的な情報は、多くの企業情報サイトの元データになっています。ここが古いと、転載先も古いままです。
次に、AIが実際に出典にしたページを一つずつ見ます。ChatGPTの答えに付いた出典リンクを開けば分かります。
すべてが直るとは限りません。それでも、AIが実際に引いた出典から順に当たるのが、いちばん効きます。
古い記事を減らすだけでは、量の差は埋まりません。今の会社を説明する、新しい第三者のページを増やします。
例えば、今の事業についてのプレスリリース、業界団体や取引先のサイトでの紹介、取材記事などです。中身は自社サイトの会社概要と同じ事実にそろえます。食い違いがあると、AIはどちらを信じるか迷います。
Wikidata(誰でも編集できる、機械が読むための百科事典的なデータベース)に会社の項目を作る方法もあります。ただしWikidataには掲載基準があり、「信頼できる、公開された参考資料で説明できる」ことなどが求められます。出典になる第三者の記事がない段階では、先に手順4の記事づくりが要ります。項目ができたら、手順1の構造化データの sameAs にそのURLを入れます。
最後に、直る前と同じ条件で聞き直します。条件をそろえないと、変わったのか比べられません。
記録するのは、答えの文面、表示された出典、間違っていた項目です。検索の索引に反映されるまでには時間がかかるので、一度で判断せず、間をあけて何度か測ります。
Googleは、AIによる概要やAIモードに表示されるために、新しい機械向けファイルやAI用のテキストファイルは要らないとしています。まずは検索で見つかること、文字で書かれていること、構造化データが中身と合っていることが先です。
チャットの中で訂正すれば、その会話の答えは変わるかもしれません。ただ、ChatGPTの検索は、その都度ウェブを探して出典を選びます。出典になっているページが古いままなら、別の人が聞いたときにまた同じ答えになると考えておくほうが安全です。
どのAIも、検索で見つかったページを土台にしている点は同じです。だから、手順1〜4は特定のAI向けではありません。どこから直すかは、手順5の測定で間違いが大きかったAIと、その出典を見て決めます。
直す順番は分かっても、自社が今どう説明されていて、どの出典が原因なのかは、測ってみないと分かりません。AI会社台帳では、社名とURLだけで、主要なAIが御社をどう説明しているか、どの出典を引いているかを測る無料診断を行っています。気になったときの最初の一歩としてお使いください。無料診断はこちら
社名とURLだけで、測定条件を明記した結果をメールでお届けします。電話営業はしません。
無料で測る →