AIの推薦は一日で変わるのか
今朝あらためて測りました。8月6日にAIが挙げた81の名前のうち、8日に再び出てきたのはわずか15。48時間もつものと、動くもの。その理由。
ちょうど一年余り前、2025年8月7日、OpenAIはChatGPTの既定モデルを一夜にしてGPT-5へ差し替えました。何百万人もの利用者が、回答の調子と中身が一斉に変わるのを目にします。反発は大きく、旧モデルは8月12日に有料契約者向けへ戻されました。そしてまた同じことが起きます - 2026年5月5日、GPT-5.5 Instantが新しい既定になりました。一年で二度、アシスタントの下にあるエンジンが入れ替わったのです。名前を挙げられる側、あるいは挙げられなくなる側の企業には、何の予告もなく。
心配すべきだったのか。私たちは測ることを選びました。今朝、2026年8月8日、8月6日の四つの質問を一語一句そのまま出し直しました。ボルドーとリールで一番いい配管業者は、という、客が打ち込むとおりの言い回しで、同じ三つのアシスタント - ChatGPT、Gemini、Perplexity - に。十二の回答を取り直し、木曜の十二と突き合わせます。表題への答えは、はい、それも大幅に。木曜に挙がった81の異なる名前のうち、土曜に再び現れたのは15だけ。しかもその15のうち二つは、集計が拾った見出しであって企業ではありません。挙げられた名前のおよそ六つに一つが48時間もった、ということです。AEO(Answer Engine Optimization:アシスタントの回答の中に存在すること)が最初に正面から見るべきなのは、この不安定さです。
今朝、正確には何を測ったのか
手順は一文で足ります。同じ質問、同じ三つのエンジン、同じモデル、48時間の間隔、両側で十二の回答、名前は私たちの報告書と同じ解析器で数える - ですから差はすべて回答側の動きであって、方法の揺れではありません。本当の発見はエンジンごとの内訳にあります。ChatGPT、ウェブ検索なしのAPI経由:26のうち残ったのは零。Gemini:29のうち一つ - 全国展開の水回り専門店Espace Aubade。Perplexity、三つのうち唯一、答える時点でウェブを読むエンジン:28のうち12が残りました。
木曜に自信をもって挙げられた名前が、土曜には挙げられない - それを持ち出した当のエンジンにすら。
最も物語る例を挙げます。木曜、ChatGPTは「Plomberie Lille Services」を、いかにも確からしい理由つきで薦めてきました。私たちがどの実在企業にも結びつけられず、未確認として印をつけた名前です。土曜には、もう一度も口にしません。書いた本人が繰り返さないのです。断り方も一定ではありません - 木曜は四問中三問を断り、土曜は四問中二問でした。
なぜ、これほど名前が残らないのか
安定性は「AI」の性質ではなく、その情報源の性質だからです。ChatGPTは記憶から答えます - 土曜の回答で自ら書いています。「2023年までに入手できた評価と推薦に基づく」(訳は私たち)。生成のたびに標本を引き直す記憶は、引くたびに違う一覧を出します。一方Perplexityは、質問された時点で名簿を読み直します。BilikやThreeBestRated、Travaux.comが48時間で変わっていないから、その名前は残るのです。しかも残ったものの順を見てください - まず名簿と媒体そのもの、次にそこが順位づけしている職人たち。AI上の可視性で安定している層は、書かれた情報源です。一度きりの生成という籤ではありません。
そこに問題の規模を足します。既定モデルが替わる日 - 2025年8月7日、2026年5月5日 - には、数千万人分の回答が同じ日に配り直されます。あなたも、競合も、客も何もしていないのに、点数が動きうるということです。ですから単発の一枚は、良くても悪くてもほとんど何も語りません。語るのは系列のほうです - 測るたびにあなたの名前がどれくらいの頻度で戻ってくるか、そしてそれを運んでいる情報源は何か。
明日の朝、何をするか
- 一度の測定から結論を出さないこと - 零に慌てず、良い点数に勝ち名乗りを上げず。決まった間隔で測り直してください。意味があるのは傾向であって、点ではありません。
- 残った層に投資すること。ウェブを読むエンジンが参照する名簿と媒体です。私たちの測定で48時間後もなお挙がっていた職人は、すべてそこから来ていました。
- 既定モデルが切り替わった日付を控えておくこと(公開されています)。切替の日にあなたの可視性が動いたなら、原因はおそらくあなたより上にあります - あなたの事業の中ではなく。
- 三つのエンジンを別々に、無料で、60秒で測ること。そして翌月もう一度測ること。商品は比較であって、写真ではありません。
最後にいつもの正直さを。四つの質問、十二の回答、二つの都市、一つの職種 - これは世論調査であって、全数調査ではありません。それでも桁の大きさは、私たちの三つの全国調査がすでに示しているもの(三つのエンジンが互いに一致する名前は2から3%にすぎない)と重なりますし、日付があり、公開され、再検証できます。AIの推薦は状態ではなく、出来事です。出来事は管理できません - 管理できるのはその頻度です。