投資家が企業について調べるとき、検索エンジンの代わりに AI に質問する場面が増えています。そうなると「IR サイトはもう見られなくなるのでは」という声も聞こえてきます。では実際に、AI は何を根拠に企業について答えているのでしょうか。そして、その答えは正しく、最新なのでしょうか。
株式会社シュタインズは2026年10月1日、東証上場企業30社について ChatGPT・Perplexity・Gemini の3つの AI に投資家目線の質問を投げました。そして回答の一つひとつを、AI 自身が示した出典と照合しました。結論から言うと、IR の重要性は下がっていません。ただし、IR サイトの役割の中身は変わりつつあります。
この記事のポイント
- AI は決算短信などの PDF を読んでいる。 公式サイトの情報だけで答えさせたとき、正しい回答の約半分(51%)は PDF が根拠でした。
- 公式サイトを指定せずに聞くと、根拠の多くは公式サイト以外。ただし、その半分は企業自身の開示資料。 普通に質問したときの正解の根拠のうち、公式サイトは35%でした。一方で、適時開示や決算短信の配信サイトなど、企業の開示資料の転載がさらに35%あり、合わせて約7割が企業の作った開示資料でした。
- 経営の考えやリスク対応は、AI が公式サイトに取りに来る。 「リスク・課題への対処方針」「投資の魅力・成長戦略」の質問では、根拠の半分以上が公式サイトでした。決算の数字に関する質問では2〜3割にとどまります。
- 企業が最新の情報を分かりやすく出していないと、AI は古い・不正確な情報で答える。 古い決算期の数字を答えた割合は Gemini で20%、実在しない URL を出典にしたものは Gemini で14%ありました。
検証の方法
対象企業
当社が IR サイトを評価している東証上場企業から30社を選びました(本当は4000社全部やりたかったのですが、お金がかかりすぎる!!)。うち24社は、当社評価の点数帯と時価総額に偏りが出ないよう無作為に抽出しています。残りの6社は、当社の2つの評価指標の判定が大きく食い違う企業です。実験期間中に決算発表が重なる可能性のある企業は除外しました。
質問内容
投資家が知りたい次の5つを質問し、いずれも「出典URLも示してください」と添えました。
- 直近の決算の売上高・営業利益、前期比、会社計画に対する進捗
- 業績が変動した主な要因、要因ごとの影響額、経営陣の評価
- 今期(来期)の業績予想とその前提条件、中期経営計画の数値目標
- 主なリスクや経営課題と、経営陣の対処方針
- 投資先としての魅力(競争優位、成長のけん引役、株主還元方針など)
聞き方は次の2種類です。
- 公式サイト限定:「〇〇社の公式サイト(ドメイン名)の情報だけを使って」とURLを指定する
- 普通の聞き方: 公式サイトを指定せず自由に
使用した AI
| AI | 使い方 | 質問の範囲 |
|---|---|---|
| ChatGPT | gpt-5.5 + Web 検索(OpenAI API) | 公式サイト限定のみ。最初の10社は5問すべて、残り20社は質問1〜3 |
| Perplexity | Agent API(設定「low」) | 2種類の聞き方 × 5問 |
| Gemini | gemini-3.8-flash + Google 検索 | 2種類の聞き方 × 5問 |
回答は合計710件です。ChatGPT は1回の質問で平均13回の検索・ページ閲覧を行い、1回あたりの費用が他の AI の30倍以上かかったため、質問範囲を絞りました(高い!)。
採点方法
AI が示した出典ページを当社で取得し、回答内容が本当にそこに書かれているかを照合しました。採点は質問ごとに5つのチェック項目(例:質問1なら売上高、利益、前期比、会社計画比、会計期間)で行い、次のように判定しています。
- 正解: 出典に書かれており、最新の決算期のもの
- 古い: 出典に書かれているが、古い決算期のもの(開示日が質問日から約3か月を超えるもの)
- 誤り・出典なし: 出典と食い違う、または出典に書かれていない
照合は AI(Claude)が行い、判定の根拠となった引用が出典の本文に実在するかをプログラムで機械的に確認しています。なぜClaudeを検索に利用せず、照合だけに利用したかというと、Claudeを検索に含めると、照合の際に自分の結果を甘く見積もる可能性があったからです。実際の審査と同じですね。なので、検索に使うAIと評価に使うAIを分けました。
結果1:AI は決算短信などの PDF を読んでいる
正解と判定された回答のうち、根拠となった出典が PDF だった割合です。
| 聞き方 | ChatGPT | Perplexity | Gemini | 全体 |
|---|---|---|---|---|
| 公式サイト限定 | 74% | 51% | 33% | 51% |
| 普通の聞き方 | ― | 64% | 16% | 40% |
公式サイトから答えた正解の約半分は、決算短信や決算説明資料などの PDF が根拠でした。特に ChatGPT は、正解の4分の3が PDF からでした。
「AI は PDF を読めないので、IR 情報は HTML で出すべきだ」という見方があります。しかし少なくとも今回使った AI は、PDF を開いて内容を読み取っていました。実際、当社の HTML 本文だけを見る評価で0点だった証券会社について、AI は公式サイトの決算短信 PDF から最新の業績を正しく答え、実 AI での得点は84点でした。
結果2:普通に聞くと根拠の多くは公式サイト以外。ただし約7割は企業自身の開示資料
公式サイトを指定しない「普通の聞き方」で正解と判定された回答について、AI ごとに根拠がどこにあったかです。
| AI | 企業の公式サイト | 公式サイト以外 |
|---|---|---|
| Perplexity | 47% | 53% |
| Gemini | 24% | 76% |
一見すると、AI は企業の IR サイトをあまり見ていないように見えます。しかし「公式サイト以外」の中身を分けてみると、印象は大きく変わります。普通の聞き方での正解の根拠1,106件を、出どころ別に分類し直した結果が次の表です。
| 根拠の出どころ | 割合 | 主なサイト |
|---|---|---|
| 企業の公式サイト | 35% | 各社の IR ページ・決算短信 PDF |
| 企業の開示資料の転載・配信 | 35% | 東証(JPX)の適時開示、決算短信の配信サイト(ifis)、IR 資料の配信サービス(大和IR・IR Pocket)など |
| 第三者の記事・データ | 30% | Yahoo!ファイナンス、株探、note など |
つまり、AI の回答の約7割は、企業が作った開示資料そのものが根拠でした。投資家や AI が御社の IR サイトに直接アクセスしていなくても、御社の開示が AI の答えの元になっています。
結果3:経営の考えやリスク対応は、AI が公式サイトに取りに来る
普通の聞き方で、質問の種類ごとに根拠が公式サイトだった割合を見ると、はっきりした差がありました。
| 質問 | 公式サイトが根拠の割合 |
|---|---|
| Q1 直近の業績 | 28% |
| Q2 業績変動の要因 | 17% |
| Q3 予想・中期目標 | 30% |
| Q4 リスク・課題と対処方針 | 54% |
| Q5 投資の魅力・成長戦略 | 53% |
決算の数字(Q1〜Q3)は、転載サイトや株価サイトにも広く載っているため、AI はそちらからも答えます。一方で、経営陣の考え、リスクへの対処、成長の筋道(Q4・Q5)は企業自身にしか書けないため、AI は公式サイトに取りに来ています。
結果4:「最新の数字」を答えられるかは AI によって違う
業績の実績や予想など、時期が問題になる項目で「古い決算期の数字」を答えた割合です(公式サイト限定)。
| AI | 古い数字を答えた割合 |
|---|---|
| ChatGPT | 4% |
| Perplexity | 11% |
| Gemini | 20% |
同じ企業の同じ公式サイトを見ても、最新の決算までたどり着けるかどうかは AI によって異なりました。ChatGPT は1回の質問で多くのページを開いて確認しており、古い数字を答えることが最も少なくなっています。質問1〜3の得点率も ChatGPT 54%、Perplexity 49%、Gemini 45% と、ChatGPT がやや高い結果でした(この差は統計的には検定していません)。
結果5:AI は実在しない URL を出典に示すことがある
AI が出典として示した URL のうち、当社が取得したときにページが存在しなかった(404)割合です。
| AI | 存在しなかった割合 |
|---|---|
| Gemini | 14% |
| Perplexity | 3% |
| ChatGPT | 1% |
出典として示された URL の中には、IR サイトにありそうな形をしていても、実際には存在しないページが含まれていました。また「公式サイトだけで」と指定しても、第三者サイトを出典に混ぜる回答もありました。
企業が最新の情報を分かりやすく出していないと、AI は手近な第三者の情報や古い資料で答えてしまいます。
IR は不要になるのではなく、役割が変わる
今回の結果を踏まえると、AI の時代に IR サイトが果たす役割は次のように変わりつつあると当社は考えています。
| これまでの見方 | 今回のデータからの見方 |
|---|---|
| IR サイトは「投資家が直接読みに来る場所」 | AI と第三者サイトの「元データの発信源」。転載も含めると回答の約7割の根拠 |
| 数字を載せることが中心 | 数字は転載で広まる。企業にしか書けない経営の考え・戦略・リスク対応の価値が相対的に上がる |
| 見に来てもらえるかが勝負 | 最新で正確な一次情報を出しているかが、AI の回答の正しさを左右する |
また、データ以前の前提として、決算短信などの適時開示は上場企業の義務であり、AI があってもなくなりません。IR の相手は AI だけではなく、アナリストや機関投資家との対話も引き続き重要です。
IR の目標は「IR サイトを見に来てもらう」ことから、「AI が答えるときの元データとして、正確で最新で、企業にしか書けない情報を出す」ことへと広がっています。
IR ご担当者がいま確認できる6つのこと
今回の結果から、次の点を確認されることをおすすめします。なお、いずれも今回の検証で効果を直接測ったものではなく、観察された AI の動きにもとづく当社の考察です。
- 自社名で AI に聞いてみる。 普通の質問と公式サイトを指定した質問の両方で、AI がどの資料を出典にし、どの決算期の数字を答えるかを確認する。
- 最新の決算資料が「最新」だとわかるようにする。 AI によっては古い資料を最新と判断して答えます。決算ページでは最新期の資料を一番上に置き、決算期の名称と開示日をページのテキストとして明記する。
- PDF も「読まれる資料」として整える。 AI は PDF を読んでいます。文字が画像になっていないか、表の数値がテキストとして抽出できるかを確認する。
- 主要な数値はページ本文(HTML)にも載せる。 PDF を開いて読むかどうかは AI によって差があります。本文にあれば、より多くの AI が読み取れると考えられます。
- 経営の考え・リスク対応・成長戦略を、自社の言葉で明確に書く。 これらは AI が公式サイトに取りに来る情報です。中期経営計画や統合報告書の要点を、ページ本文でも読める形にしておく。
- 転載先・第三者サイトに載っている自社の情報も確認する。 普通の質問では、AI の回答の根拠の多くが公式サイト以外でした。適時開示の内容や、株価・決算情報サイトでの自社の数値が正しく最新かを確認する。
当社の評価方式への反映
当社の提供するスコアリングは、これまで IR サイトの HTML 本文から AI が答えられるかを評価しており、PDF の中身や情報の新しさは点数に反映していませんでした。今回、この評価が実際の AI の回答とどれだけ一致するかを確かめたところ、次の結果となりました(無作為に選んだ24社での順位相関)。
| 評価方式 | 実際の AI の回答との一致(順位相関) |
|---|---|
| 現行方式(HTML 本文のみ) | 0.56 |
| 改定案(PDF にある情報を割り引いて加点し、古い情報は加点しない) | 0.77 |
改定案の方が、実際の AI の回答に統計的に有意に近い結果でした。PDF の加点だけ、古い情報の扱いだけでも一致は高まり(順位相関 0.63、0.69)、両方を組み合わせたときが最も高くなりました。当社はこの結果をもとに評価方式の改定を進めます。なお、HTML で最新の情報を出している企業が最も高く評価される点は変わりません。
検証の限界
- 対象は30社で、評価方式の比較は無作為に選んだ24社で行いました。数値の誤差の幅は大きく、細かな差は判断できません。
- 採点は AI(Claude)による照合で、人手による確認は実施中です。結果は暫定値です。
- 根拠の出どころの分類(公式サイト/開示資料の転載・配信/第三者の記事・データ)は、サイトのドメインと PDF かどうかによる機械的な分類で、おおよその値です。
- ChatGPT は費用の都合で、30社中20社は質問1〜3のみ、また公式サイト限定の聞き方のみで実施しました。
- いずれの AI も API 経由で使用しました。一般の利用者が使うアプリ版とは、モデルや設定が異なる場合があります。なお、API の Perplexity は、OpenAI のモデルに Perplexity 独自の検索を組み合わせた構成でした。
- AI の回答は質問のたびに変わることがあり、各 AI のモデルも随時更新されます。結果は2026年10月1日時点のものです。
御社の IR 情報が AI にどう答えられているか、確かめてみませんか
シュタインズでは、IR サイトの機械可読性の評価や、AI に正確で最新の情報が伝わる情報発信のご相談を承っています。「自社名で AI に聞いたらどう答えるのか」「どの資料が根拠になっているのか」を確認したい方は、お気軽にお問い合わせください。
調査概要
- 調査主体:株式会社シュタインズ
- 実施日:2026年10月1日
- 対象:東証上場企業30社
- 使用 AI:ChatGPT(gpt-5.5)、Perplexity(Agent API)、Gemini(gemini-3.8-flash)
- 回答数:710件