MetaのAI検索インデックス、GoogleとBingへの依存を超えて前進

Pieter Levelsは、Metaの従業員がAI検索クエリをGoogleに渡さない計画を説明したと述べ、2024年に報じられたプロジェクトに裏付けのない動機を付け加えた。

By · Published

Primary source: X

Why it matters

A proprietary web index would give Meta control over retrieval costs, ranking and AI query data while reducing dependence on Google and Microsoft. It would also make Meta a new gatekeeper between publishers and billions of users across its apps.

Illustration of magnified source code and web-crawl markers representing Meta's AI search index and web crawling project.

Pieter Levels (@levelsio) said in an August 6th post on X that a person he identified as a Meta employee privately described Meta's effort to build its own web index, claiming the project would keep Meta AI's search traffic and resulting data away from Google.

Levelsは、メッセージを許可を得て公開したと述べた。情報源は匿名で、投稿はその従業員の身元や、GoogleがMeta AIの検索活動にアクセスするという特定の主張を立証する文書やその他の証拠を提示していない。その説明は裏付けられていないままである。

Metaの基盤となる検索プロジェクトは確立されており、少なくとも2024年に遡る。The Information reported in October 2024 that Meta was developing a search engine capable of crawling the web and supplying current information to Meta AI. Reuters reported on October 28th, 2024 that the work was intended to reduce Meta's dependence on Google and Microsoft's Bing, which were supplying information about news, stocks and sports.

その区別は重要だ。検証された報道は、Meta AIの検索(リトリーバル)インフラに組み込まれるウェブインデックスの構築を支持している。だが、それがMetaがGoogle Searchを直接模した独立した汎用の検索サービスを公開する計画を意味するものではないことは確かだ。

Levelsは、Photo AI, Interior AI, Remote OK and Nomadsを含むポートフォリオを持つ個人のソフトウェア創業者であり、その非公開メッセージをMetaの投資の動機に関する新情報として位置づけた。彼の説明によれば、AIによって生成された検索をGoogle経由で送ると、Googleが自社のシステムを改善するために利用できる価値あるクエリ活動が露出することになるという。投稿は、Googleがどのようなデータを受け取るのか、どのような契約上の保護策が適用されるのか、あるいはその懸念がモデルの学習、検索ランキング、製品分析、またはそれらの組み合わせに関するものなのかを特定していない。

Metaは、最初の2024年の報道以来、独立したリトリーバルスタックの構成を続けている。Metaがlaunched its standalone Meta AI app in April 2025した際、同社はアシスタントがウェブ全体を検索できると述べたが、クエリの種類ごとに基礎となる提供元を特定するとは述べなかった。

またMetaは、クロールのみを頼るのではなくライセンスされた情報源も追加した。a December 2025 announcementでは、MetaはCNN、Fox News、Le Monde Group、People Inc.、USA Todayなどの出版社をMeta AIでのタイムリーな情報とリンクの情報源として挙げた。Metaはその後、2026年3月に追加のパートナーとともにその一覧を更新している。

2026年6月、MetaはAI Mode inside Facebook searchを導入し、GroupsやReelsを含むFacebook製品の公開資料を根拠に回答を生成するようにした。これにより、Metaはライセンスされたニュースフィードやオープンウェブに加えてもう一つの独自のコーパスを得たことになる。

クロールインフラには目に見える公開の足跡がある。ユーザーエージェント meta-webindexer/1.1 は2026年の間にウェブサイトのログに現れており、crawler references citing Meta's webmaster documentationは、それを公開ページをMeta AIの検索回答や引用の対象にするためのインデクサーとして説明している。したがって、Metaの検索構築は単に新たに持ち上がった内部の構想を超えてかなり進んでいるが、Metaはインデックスの対象範囲、ランキングシステム、または個別のMeta AI製品における役割について公に詳細を明らかにしてはいない。

インデックスを所有することは、特定の「Googleが学習に利用する」という説明が正しいことを前提としなくても、Metaに戦略的な利点をもたらす。Metaは新鮮さ、ランキング、取得コスト、クエリデータをコントロールでき、独自のAIアシスタントを運営する二つの競合他社への依存を減らすことができる。また、どの出版社が回答に登場するか、ユーザーがいつ外部リンクを受け取るか、ライセンスされた資料がクロールされたページやMetaのプラットフォームに直接投稿されたコンテンツとどのように競合するかを決定することもできる。

Levelsの投稿は、その確立された戦略に対する内部的な正当化の主張を追加するものである。証拠はMetaの検索独立性に向けた推進を支持している。だが、Meta AIの検索をGoogleが学習に使えないようにすることがそれを推進する理由である、というより強い主張を支持するにはまだ至っていない。

Reader comments

Conversation for this story loads after sign-in.