Googleは、従来の検索ボックスをマルチモーダルなAI入力口へと変え、AI OverviewsとAI Modeを統合して検索ワークフローを再構築している。

Googleは、25年間にわたりウェブ検索を定義してきた検索ボックスを再設計し、コンパクトなキーワード入力欄から、AI支援会話のためのマルチモーダル入力口へと変えつつある。この変更により、ユーザーは長い質問、画像、PDF、動画、ファイル、そして開いたChromeタブのコンテンツを、メインの検索インターフェースから直接送信できる。
Google I/Oで発表され、VentureBeat AIが報じたこの再設計は、AI OverviewsとAI Modeも一つの連続した検索フローへまとめる。Googleによれば、目的は従来の結果ページとAI優先の体験のどちらかを選ばせる状態をなくすことにあり、この変化は人々の検索方法、出版社のトラフィック獲得、企業の発見性最適化に影響を与える可能性がある。
再設計された検索ボックスは、ユーザーがより長いクエリを入力するにつれて広がる。この見た目の変化は小さいが、検索行動のモデルが異なることを示している。つまり、質問を2〜3個のキーワードに縮めるよう促すのではなく、問題を詳しく説明するようGoogleが促しているのだ。
インターフェースはまた、主要な検索入力口でマルチモーダル入力を受け付ける。報道によれば、ユーザーは画像、PDF、動画、その他のファイルをアップロードしたり、Chromeタブから素材を取り込んだりできる。これらの機能の一部はすでにAI Modeで利用可能だったが、Googleの再設計では別の場所の裏に置くのではなく、よりなじみのある検索ワークフローに近づけている。
VentureBeatによる企業ブリーフィングの説明によれば、Googleは従来のオートコンプリートを超えるAI駆動のクエリ提案システムを追加している。次の単語だけを予測するのではなく、このシステムはAI Modeで処理できる、より詳細な質問の作成を支援することを意図している。
これは検索ボックスの役割を、受動的な入力欄から能動的なガイドへと変える可能性がある。プロダクトチームにとって重要なのは、結果が返される前に、インターフェースがユーザーの意図形成を始めるかもしれないという点だ。
より大きな変化は、見た目よりもアーキテクチャ上のものかもしれない。Googleは、従来の結果の横または上に表示されるAI Overviewsを、より会話的な検索体験であるAI Modeと統合している。
報じられている流れでは、ユーザーは質問をして、リンクと従来の結果を含むAI Overviewを受け取り、その後、別の検索モードを開かずにフォローアップ質問を続けられる。したがって、Google Searchは独立したクエリの連続というより、継続的なリサーチセッションに近づいている。
Googleの副社長でSearch責任者のLiz Reid氏は、ユーザーが従来のページかAI中心の体験かを事前に決める必要はないと記者団に語った。VentureBeatによると、同社の立場は、統合された入力口が、あえてAI Modeを探しに行かない人々にも高度な機能をより利用しやすくするというものだ。
展開は、AI Modeが利用可能な国と言語から始まると報じられている一方、統合された体験はモバイルとデスクトップで世界的に開始されるとされている。ソースは国別の詳細なスケジュールを示していないため、利用可否は市場やアカウントによって異なる可能性がある。
Googleは、この再設計を自社のAI検索製品の利用数とともに発表した。同社によると、AI Modeは米国で初年度に月間10億人を超え、AI Modeのクエリ数はローンチ以来四半期ごとに倍増したという。また、AI Overviewsは月間25億人超に達し、検索全体のボリュームも前四半期に過去最高を記録したと述べた。
これらはベンダー発表の採用指標であり、VentureBeatのブリーフィング報道を通じて伝えられたもので、独立に検証された測定値ではない。Google CEOのSundar Pichai氏は、これらの数字を用いて、AI機能が従来の検索を置き換えるのではなく検索活動を増やしていると主張した。この結論はあくまで同社の解釈であり、提示された証拠だけでは、利用の定義や、活動のどれだけが新しい行動なのか、それとも検索面の移動なのかは分からない。
Googleによれば、この再設計された体験ではGemini 3.5 Flashが使われる。同社は、このモデルが以前のGemini 3.1 Proモデルをほぼすべてのベンチマークで上回り、同等のフロンティアモデルより大幅に高速に出力を生成すると主張している。これらの性能主張もベンダー発表によるもので、利用可能な証拠には完全なベンチマーク手法、独立テスト、実運用のレイテンシーデータは含まれていない。
それでも速度は製品戦略の中心だ。検索ユーザーは即時の応答を期待しており、目立つ遅延を生む会話型システムは、Googleが維持しようとしている習慣を損なう可能性がある。より高速なモデルはGoogleが提供コストとレイテンシーを抑える助けになるかもしれないが、ソースは1クエリあたりの経済性や、裏側でより大きなモデルがどの程度使われるのかを明らかにしていない。
Googleは、この再設計されたインターフェースを回答だけにとどめず拡張している。同社によれば、生成UIシステムは質問に応じてインタラクティブなウィジェット、可視化、小さなアプリケーションを作成する。Reid氏が挙げた例では、ブラックホールが時空に与える影響をインタラクティブに説明し、フォローアップ質問によって新しいビジュアルが生成されたという。
Googleによると、これらの体験はGoogle DeepMindと共同開発され、Gemini 3.5 Flashによって駆動されるリアルタイムのコード生成に依存している。生成UIは夏に広く無償で利用可能になる予定で、さらに永続的でカスタマイズ可能な体験はその後、米国のGoogle AI ProおよびGoogle AI Ultraの加入者向けに提供される。
同社はまた、ウェブを監視し、指定条件が満たされたときにユーザーへ通知できる情報エージェントも予告した。想定される用途には、金融セクター、賃貸物件、製品リリースの追跡などが含まれる。これらのエージェントは、まず有料加入者向けに提供される見込みだ。
開発者にとって、これは競争領域を広げる。検索はもはやウェブページの配信層だけではなく、Googleが一時的なインターフェースを構築し、継続的な監視を行う場所にもなり得る。これはより豊かな回答の機会を生む一方で、出典の帰属、エージェントの信頼性、権限、検索結果と自動化サービスの境界についての疑問も提起する。
最初のシグナルは実際の利用可能性だ。どの国、言語、アカウント、デバイスが再設計された検索ボックスを受け取るのか、そしてマルチモーダル入力が一貫して有効化されるのか。Googleの展開に関する表現は広範なローンチを示唆しているが、ソースはすべての機能が同時に全地域へ届くとは示していない。
出版社はリファラルトラフィックと、AI OverviewsおよびAI Mode内でのリンクの視認性を注視すべきだ。会話型セッションでは、GoogleがAI機能はウェブへのトラフィックを増やし得ると主張していても、クリックを必要とせずに複数のフォローアップ質問に答えられる可能性がある。広告主も、商業結果が複数ターンの会話にどう組み込まれるのか、そして長い対話を通じて意図がどう測定されるのかを確認する必要がある。
開発者や企業購買担当者は、生成されたビジュアルや情報エージェントが検証可能なソース、安定した出力、有用な制御を提供するかを評価すべきだ。説得力のあるデモと信頼できるワークフローの違いは、監視、引用、失敗時の処理、データアクセス方針に左右される。これらの詳細は、ここで利用できる証拠の中ではGoogleが十分に明示していない。
Googleの再設計が重要なのは、ユーザーに新しい独立したAI製品の採用を求めることなく、検索のデフォルト動作を変えるからだ。ファイル、画像、フォローアップ質問、エージェント的機能をなじみ深い検索ボックスの中に置くことで、Googleは会話型AIを任意機能から情報作業の通常の出発点へと移せる。
Googleにとっての機会は、より高いエンゲージメントと、より豊かな意図シグナルだ。リスクは、より自己完結的な検索体験が出版社への圧力を強め、ユーザーが出典付き情報と生成された要約を区別しにくくなることだ。展開、独立した利用データ、リンクと引用の品質が、これがより高性能な検索インターフェースなのか、それとも単により自動化されたものなのかを決めるだろう。