Accueil › Veille & nouveautés SEO › Nouveautés SEO du 21 septembre 2026 : Cloudflare et l’IA

Cette semaine du 21 septembre, Cloudflare a séparé l’entraînement des IA de la recherche, Google a encore baissé la barre de ses profils, et Chrome s’est mis à compter les pubs sur les pages. Comme chaque lundi, je t’ai trié la veille SEO et GEO et je te dis ce que chaque nouveauté change pour ta pratique.

En resumen

  • Cloudflare te laisse interdire l’entraînement des IA dans le robots.txt tout en laissant passer Googlebot, Applebot et Bingbot. Si tu coches « Block », en revanche, tu les coupes tous, Google compris.
  • Google ouvre ses profils de recherche dès 10 000 abonnés sur un seul compte YouTube, Instagram, X ou TikTok. C’est réservé aux États-Unis pour le moment.
  • Le CrUX, le rapport où Chrome publie les données de navigation de vrais internautes, mesure maintenant la place et le poids des publicités sur une page.
  • L’État publie son premier guide d’usage de l’IA pour ses agents, avec un test simple sur les données à ne pas confier aux outils gratuits.

01Cloudflare : bloquer l’entraînement des IA sans bloquer Googlebot

Cloudflare a changé ses réglages de robots d’IA le 15 septembre. Sa nouvelle option, Disallow AI Training, écrit dans ton robots.txt que tu refuses l’entraînement des IA, tout en laissant Googlebot, Applebot et Bingbot explorer ton site pour la recherche. En juillet, Cloudflare prévoyait l’inverse : bloquer l’entraînement devait aussi bloquer ces trois robots, puisqu’ils servent aux deux.

Attention au réglage d’à côté. L’option « Block » arrête maintenant ces trois robots complètement, recherche comprise. Les sites qui bloquaient déjà l’entraînement basculent d’office sur Disallow AI Training, et l’ancien interrupteur « Block AI Bots » va disparaître. Les nouveaux domaines qui déclarent vivre de la publicité se voient proposer Disallow AI Training dès l’inscription.

Pour garder l’accès à la recherche, un robot doit être jugé « responsable » par Cloudflare, ce qui passe par quatre conditions :

  • permettre de refuser l’entraînement, par le robots.txt ou un standard proche ;
  • permettre de sortir des résumés générés par l’IA ;
  • montrer page par page ce qui a servi à l’entraînement, avec des chiffres sur la recherche ;
  • garantir que refuser l’entraînement ne pénalise pas le classement classique.

Selon Cloudflare, Google, Apple et Microsoft remplissent ces conditions, avec des fonctions déjà en place et des promesses datées pour le reste. Chez Google, le refus passe par Google-Extended, et l’affichage dans les AI Overviews et l’AI Mode se règle à part, dans la Search Console. Chez Bing, le robots.txt ne transmet pas encore ce refus : Cloudflare vise début 2027. Cloudflare prépare aussi Bot Preference Sync, un outil qui écrira ton robots.txt à ta place à partir de trois réglages. D’après l’annonce, les nouveaux clients l’auront activé d’office, et rien ne se règle robot par robot.

La reacción adecuada

Si ton site ou celui d’un client passe par Cloudflare, ouvre les réglages des robots d’IA et relis ton robots.txt dans la foulée. Un « Block » coché trop vite coupe aussi Google. Et si tu veux autoriser OpenAI mais pas un autre, le mode automatique ne sait pas faire : il faut garder la main sur le fichier.

Leer la fuente

02Profils de recherche Google : le seuil descend à 10 000 abonnés

Google a encore baissé la barre d’accès à ses profils de recherche, ces pages qui regroupent les articles d’un média ou d’un créateur et ses posts sur les réseaux. Il suffit maintenant de 10 000 abonnés sur un seul compte YouTube, Instagram, X ou TikTok. Au lancement, le 4 juin, il en fallait 100 000 sur YouTube, Instagram ou X, ou 300 000 sur TikTok, et la page d’aide affichait encore 35 000 le matin de l’annonce.

Deux autres nouveautés arrivent avec. Un groupe de médias peut gérer les profils de toutes ses marques depuis un seul compte Google, alors qu’il en fallait un par profil. Et les articles s’affichent avec des titres plus longs et des vignettes retravaillées, sans que Google donne de dimensions.

Google publie aussi un guide pour poser un badge « profil de recherche » sur son site. D’après sa documentation, un profil n’influence pas directement le classement : son intérêt est dans Discover, où les abonnés d’un profil voient plus facilement ses contenus. Le journaliste de Search Engine Journal y voit surtout une réponse à la baisse du trafic envoyé par la recherche IA.

Lo que hay que recordar

C’est réservé aux États-Unis pour l’instant. Robby Stein, vice-président produit de Google Search, a annoncé une ouverture à d’autres pays « bientôt », sans date. Le seuil a bougé deux fois en quinze semaines : vérifie la page d’aide avant de conclure qu’un client n’y a pas droit.

Leer la fuente

03CrUX : Chrome mesure maintenant l’expérience publicitaire

Le CrUX, c’est le rapport où Chrome publie les données de navigation réelles de ses utilisateurs, celles qui alimentent les Core Web Vitals dans PageSpeed Insights. Google y ajoute quatre mesures expérimentales sur la publicité :

  • le nombre moyen de publicités visibles à l’écran pendant qu’on fait défiler la page ;
  • la part de l’écran qu’elles occupent ;
  • la charge qu’elles imposent au processeur ;
  • le volume de données qu’elles font télécharger.

Les données viennent des utilisateurs de Chrome qui ont accepté d’être mesurés, sur Android, ChromeOS, Linux, macOS et Windows. Chrome sur iPhone n’y est pas. On les consulte dans l’API CrUX, son historique et le panneau publicité des outils de développement de Chrome, et elles arriveront plus tard dans BigQuery.

Google les présente comme des données pour les éditeurs et les annonceurs. Rien n’indique qu’elles comptent pour le classement. Search Engine Journal se demande quand même si ça finira par compter un jour.

¿Por qué es importante?

Pour un site qui vit de la pub, c’est la première fois que Google chiffre ce que les publicités pèsent sur la navigation de vrais visiteurs. Va regarder tes chiffres maintenant, tant que Google se contente de les mesurer.

Leer la fuente

04Mediapartners-Google : le robot publicitaire ne concerne plus seulement AdSense

Google a réécrit la documentation de Mediapartners-Google, le robot qui visite les sites pour leur servir des publicités adaptées. Avant, ses consignes de robots.txt ne concernaient qu’AdSense. Maintenant, elles touchent « plusieurs produits publicitaires de Google », avec AdSense et Ad Manager donnés en exemple.

Google ne publie pas la liste complète. On ne sait donc pas si Google Marketing Platform, les annonces Local Services ou AdMob sont concernés.

La reacción adecuada

Si un robots.txt que tu gères bloque Mediapartners-Google, ce blocage peut maintenant jouer sur d’autres produits publicitaires qu’AdSense. Vérifie avec ton client avant de laisser cette ligne telle quelle.

Leer la fuente

05IA dans l’administration : l’État publie son premier guide officiel pour ses agents

La direction interministérielle du numérique, la DINUM, publie avec la DITP et la DGAFP un guide d’usage de l’IA pour tous les agents de l’État. Il répond à une enquête menée fin 2025 auprès de 2 000 agents, qui réclamaient des règles. Il n’a pas de valeur réglementaire, et une charte de ministère, quand elle existe, passe devant.

Le guide classe les outils en trois familles, selon la sensibilité des données :

  • les outils de l’administration, à privilégier, comme l’Assistant IA interministériel ;
  • les versions payantes d’outils commerciaux fournies par l’administration, à faire valider par la DSI ;
  • les versions gratuites de ChatGPT, Claude, Gemini, NotebookLM ou Le Chat, très limitées, voire interdites.

Le test proposé aux agents tient en une question : est-ce que cette information pourrait être publiée sur un site ouvert à tous ? Si la réponse est non, l’outil gratuit est exclu. Le guide impose aussi une mention du type « généré partiellement par intelligence artificielle » dès que l’IA produit une analyse, une note ou un courrier. Une simple reformulation n’en demande pas.

Il rappelle enfin que ces outils peuvent inventer des références juridiques et des chiffres, et qu’ils consomment de l’énergie : une question posée en texte consomme autant qu’une à dix recherches Google, et générer une image environ soixante fois plus qu’une question en texte. Une annexe propose des prompts réutilisables par métier.

Un test à reprendre avec tes clients

Tu peux reprendre le test de l’État tel quel chez un client : si ses données ne pourraient pas être publiées en ligne, elles n’ont rien à faire dans la version gratuite d’un chatbot.

Leer la fuente

06MIT, Anthropic et les patrons de l’IA : trois alertes en cinq jours

Trois nouvelles sont tombées entre le 8 et le 12 septembre, et Search Engine Journal les lit ensemble. D’abord une étude du MIT Media Lab, qui a mesuré l’activité cérébrale de personnes écrivant avec ChatGPT et note une baisse de 32 % de l’effort mental actif. L’étude est contestée, notamment sur la taille de son échantillon, et les chercheurs du MIT demandent qu’on arrête de parler de dommages au cerveau.

Ensuite, Anthropic a publié un modèle économique interactif. Dans le scénario le plus dur, le PIB s’envole pendant que près de 14 % des salariés perdent leur emploi à cause de l’IA, et moins de la moitié en retrouve un. Les économistes d’Anthropic refusent de dire quel scénario est le plus probable.

Enfin, Dario Amodei, le patron d’Anthropic, a appelé toute l’industrie à ralentir la progression des modèles, avec des audits indépendants et des règles mondiales. D’après le New York Times, Sam Altman, Elon Musk et Demis Hassabis se sont ralliés en quelques jours.

L’auteur donne trois conseils. Relis à la main tout ce que tu as fait écrire en grande partie par l’IA. Regarde chaque mois ton propre trafic venu des IA, plutôt que les moyennes du secteur. Et rends tes sources vérifiables, avec des experts nommés et des données qu’on peut aller contrôler.

La reacción adecuada

Si des règles d’audit arrivent, les sites qui montrent déjà qui a écrit, sur quelles sources et avec quels chiffres vérifiables partiront avec une longueur d’avance. Un contenu signé et sourcé, ça se prépare maintenant.

Leer la fuente

07Gemini : Jeff Dean raconte pourquoi le modèle est multimodal depuis le début

Interviewé par Dawn Song, Jeff Dean raconte l’origine de Gemini. Plusieurs équipes de Google, chez DeepMind, Google Brain et Google Research, avançaient chacune de leur côté vers le même but. Il a écrit un mémo d’une page pour leur proposer de tout mettre en commun, les gens, les idées et la puissance de calcul, et d’entraîner un seul modèle capable de comprendre dès le départ le texte, le code, les images, la vidéo et l’audio.

Il cite même des relevés LiDAR ajoutés à l’entraînement. Le LiDAR, c’est la mesure d’une distance au laser, et l’idée est juste que le modèle sache que ce type de données existe. Il reconnaît aussi que Gemini était un peu en retard sur le code. En le rattrapant, l’équipe a vu le raisonnement progresser, y compris sur des tâches qui n’ont rien à voir avec le code.

Son conseil aux étudiants : survoler dix articles plutôt qu’en lire un seul en détail, pour relier des idées que personne n’a encore reliées, et essayer beaucoup de choses en acceptant que certaines échouent.

Lo que hay que recordar

Gemini a été pensé dès le départ pour lire des images, des vidéos et du son. Tu peux donc lui confier une capture d’écran ou une vidéo à analyser, en plus de tes textes.

Leer la fuente

Rendez-vous lundi prochain

Le prochain tour arrive lundi, en carrousel sur LinkedIn et Instagram. En attendant, tu peux laisser les blogs anglophones tranquilles, je m’en occupe.