Surprise score
La nouveauté informationnelle d'un passage selon Titans/MIRAS. Un contenu prévisible n'est pas mémorisé par le LLM.
Lire →Ce qu'un contenu apporte que le corpus existant ne contient pas. Le critère que Google utilise pour pénaliser le contenu IA générique.
Mesure de ce qu'un contenu apporte que le corpus existant ne contient pas. Critère central du March 2026 Core Update : Google pénalise désormais les contenus qui reformulent les top 10 sans ajouter d'atome vérifiable, qu'ils soient écrits par un humain ou un LLM. Source d'information gain durable : la donnée propriétaire.
Les Quality Rater Guidelines définissent en page 42 le contenu « sans effort » : celui qui reprend mécaniquement des informations existantes sans rien y ajouter. Note la plus basse, que l'auteur soit un humain ou un LLM. Le Core Update de mars 2026 a fait de ce critère un axe central : les contenus qui reformulent le top 10 sans atome vérifiable sont pénalisés.
Le paper GEO (Aggarwal et al., KDD 2024, arxiv 2311.09735) a mesuré sur 10 000 requêtes et 25 domaines ce qui augmente la probabilité de citation par un moteur génératif : les citations verbatim +41 %, l'ajout de statistiques +34 %, la fluidité +30 %, l'ajout de sources +29 %, le ton d'autorité seulement +13 %. Le keyword stuffing dégrade : −8 % sur le benchmark, −9 % mesuré en production sur Perplexity.
Le finding le plus utile : les sites mal classés gagnent le plus. L'ajout de sources fait +115 % pour un site au rang 5 quand le rang 1 perd 30 %. Le gain d'information est un levier anti-monopole pour les petits sites.
Les moteurs vérifient les claims par atomisation : chaque affirmation est découpée en fait isolé, vérifié indépendamment. « 600 km d'autonomie, 90 000 € » fait deux atomes vérifiables et citables. « Une voiture chère avec une bonne autonomie » n'offre rien à vérifier, donc rien à citer. La source durable de gain d'information reste le dataset propriétaire : un chiffre que personne d'autre ne détient.
La nouveauté informationnelle d'un passage selon Titans/MIRAS. Un contenu prévisible n'est pas mémorisé par le LLM.
Lire →Score de similarité cosinus entre une requête et un passage de contenu : la mesure clé pour passer dans les AI Overviews.
Lire →Pratiques pour être cité dans Perplexity, ChatGPT Search et Google AI Overviews. Repose sur le Grounding Score et la Surprise Metric.
Lire →Experience, Expertise, Authoritativeness, Trustworthiness. Le cadre que les Quality Raters utilisent pour évaluer votre contenu.
Lire →Quand le web se sature de contenu IA, le retrieval des moteurs s'effondre. À 67 % de pollution, plus de 80 % des réponses sont contaminées. D'où la prime à l'humain vérifiable.
Lire →Je vous prépare un pré-audit de votre site et l'on en discute durant notre visio.