Déjà en place aux USA et dans plus de 120 pays depuis 2 ans, Google AI Overviews débarque en France cet été (c’est effectif depuis ce mercredi 22 juillet). Le principe est simple : pour chaque requête sur le moteur, c’est l’IA de Google (Gemini) qui propose des résumés ou plus exactement, et la précision me semble d’importance, des synthèses et – souvent – des préconisations.
Cette arrivée durant l’été est annoncée comme un tremblement de terre, notamment par les éditeurs de presse qui, comme c’est le cas depuis plus de 20 ans avec le lancement de Google News en 2002, ne trouvent aucune issue au pacte attentionnel Faustien qui leur a été imposé : laissez-moi indexer et réutiliser vos contenus et en échange vous serez visibles, ou empêchez-moi de le faire et l’audience de vos sites sera quasi nulle.
L’article de Nicolas Lellouche sur Numérama résume très bien les principaux enjeux de cette arrivée et le changement de statut de celui qui était, jusqu’ici, un moteur de recherche.
Il y a, bien sûr, de quoi s’inquiéter circonstantiellement toujours davantage, mais structurellement, sur le fond, rien n’a vraiment changé depuis presqu’un quart de siècle. Google est un moteur de recherche devenu un moteur de réponses (« il n’y aura plus que des réponses » prophétisait Marguerite Duras) ; Google est un béhémot calculatoire qui a bâti son succès sur un régime de captation d’externalités (le web) qu’il a progressivement transformé en autant d’internalités. D’abord sur des sources ouvertes (le web donc, et notamment Wikipédia) puis sur des sources propriétaires ou mettant en jeu des principes de propriété intellectuelle (la presse notamment). Et toujours en pratiquant « l’Opt-Out » c’est à dire la captation / prédation par défaut, libre ensuite à chacun de faire part de sa volonté d’en sortir. Et lorsque la masse de ces internalités fut suffisamment « à l’échelle », Google se trouva alors en situation de jouer à son avantage la rivalité qu’il avait lui-même créé (et arbitré) entre la qualité, l’importance et la nécessité de la production de contenus externes d’une part, et d’autre part celle de la production de réponses internes suffisamment courtes pour ne pas heurter de front la propriété intellectuelle (jouant entre l’usage « de minimis », le Fair-Use et l’exception pour courte citation) et suffisamment complètes pour satisfaire des requêtes informatives sans nécessité d’aller chercher des compléments d’information à l’extérieur du moteur ou alors en le faisant uniquement dans l’écosystème de sites tiers déjà dans le giron de la firme.
Avec AI Overviews, Google pousse donc un cran plus loin cette logique phagocyte. Et ce faisant il cesse peut-être irrévocablement d’être un « portail » (il n’en était déjà plus que l’ombre depuis longtemps mais maintenait nonobstant une fonction d’accès et d’orientation) pour devenir une simple « porte », que chaque requête sur le moteur referme derrière notre passage.
Permettez-moi alors de formuler une question volontairement provocante. Et si finalement Google était juste en train de devenir … un média ? Google dont longtemps le métier correspondant à son chiffre d’affaire fut celui d’être une régie publicitaire, et de n’être que cela (malgré ce que ses fondateurs affirmaient dans leur article séminal). Google deviendrait donc un média. Mais un média aux fonds baptismaux particuliers : entièrement construit sur la prédation d’externalités, sorte de Cronos dévorant ses enfants, il se mue aujourd’hui avec AI Overviews en média autophage qui tend à ne plus se nourrir que de lui-même. Ce « lui-même » étant permis par la volumétrie totalement inédite ainsi que par les effets de dissémination en même temps que d’opacification immanents des LLM (larges modèles de langage). La question est de savoir jusqu’où et jusqu’à quand ce principe autophage pourra être poursuivi, et la seule certitude est qu’il ne pourra pas l’être éternellement car si grande que soit l’étendue des éléments constituant aujourd’hui la ressource indexable et pouvant être générée du moteur, elle n’est pas infinie et nécessitera donc toujours et tout le temps l’appui de ressources externes (au Royaume-Uni après deux ans de déploiement le trafic vers les sites d’éditeurs à drastiquement chuté). Sauf … sauf à considérer pouvoir se satisfaire d’un pourrissement (ou d’une emmerdification) et à disposer des moyens pour faire croire qu’il n’est que périphérique et marginal.
Deux éléments pour conclure.
D’abord le mythe de Cronos dévorant ses enfants laisse place au scénario dans lequel ceux-ci se voient finalement régurgités et renversent leur père pour s’installer comme nouveaux dieux sur le mont Olympe. C’est précisément pour s’en prémunir que très tôt Google a eu l’intelligence de développer son propre LLM et pouvant s’appuyer sur l’immensité des données et des textes qu’il avait déjà collectés, traités, indexés, et dont il avait, bien avant même l’invention du terme « LLM », déjà fait corpus (à ce titre le programme Google Books exploité à l’époque avec les technologies disponibles du TALN – traitement automatique du langage naturel – fut une pierre angulaire déterminante.
Ensuite j’évoquais plus haut l’article séminal de S. Brin et L. Page dans lequel après avoir décrit la formule et l’algorithme du Pagerank ils reviennent en annexe sur la toxicité du modèle publicitaire qui fait aujourd’hui leur fortune et constitue leur seul paradigme de déploiement. Notez que ce passage (ces « annexes ») a étrangement disparu de la version accessible depuis le site de la firme, mais qu’elle est heureusement toujours présente sur la page originale du laboratoire de l’université de Stanford. La seule leçon à retenir de cela est assez simple : ne faites jamais confiance à un prédateur.

Tableau de Rubens. Cronos dévorant ses enfants
(Source Wikipedia)
