Oui, environ un tiers du temps. Nous avons cherché à démontrer une « pénalité d'auto-publication », mais les données ont refusé de confirmer cette hypothèse. Nous avons donc testé quatre théories sur ce qui distingue les pages appartenant à la marque qui sont citées de celles provenant de tiers. Trois de ces théories n'étaient que du bruit statistique. Ce rapport les inclut tout de même.
39 pages les plus citées · 12 auto-publiées contre 27 tierces · Test exact de Fisher, bilatéral · Juillet 2026 · Perplexity uniquement — voir note sur le périmètre
Sur 39 pages les plus citées, 12 étaient auto-publiées — la page d'une marque, se classant pour une question qui intéresse commercialement cette marque. 27 étaient des sites tiers : listes, annuaires, sites d'avis, articles comparatifs.
Le scénario pessimiste — « l'IA ne vous citera pas, seulement les listes qui vous devancent » — est donc faux. Elle vous cite environ un tiers du temps. Ce qui est intéressant, c'est ce qui différencie ces pages.
Nous avons testé quatre hypothèses. Voici tous les résultats, y compris les échecs :
| Trait | Auto-publié | Tiers | p (Fisher) | |
|---|---|---|---|---|
| Blocs FAQ ou tableaux de données | 75 % | 22 % | 0,004 | significatif |
| Contient des données originales | 42 % | 26 % | 0,455 | bruit |
| Format liste ou « best-of » | 75 % | 78 % | 1,000 | bruit |
| A un auteur nommé | 42 % | 44 % | 1,000 | bruit |
Un seul trait dépasse le seuil corrigé : le contenu structuré. Les pages appartenant à des marques qui sont citées ont trois fois plus de chances de contenir un bloc FAQ ou un tableau de données que les pages tierces citées.
Nous considérons que le mécanisme est purement technique et mécanique. Un bloc FAQ présente une question suivie directement de sa réponse. Un tableau regroupe des faits associés à des libellés. Les deux sont facilement extractibles. Un moteur de recherche en quête d'informations citables les trouvera plus rapidement dans un tableau que dans un paragraphe. Les articles de listes tiers n'ont pas besoin de cette aide, car leur format même leur assure le succès. Votre page, elle, en a manifestement besoin.
La structure n'est pas un simple élément décoratif. C'est ainsi que le moteur de recherche identifie la citation.
Les données originales n'ont pas fait la différence. 42 % contre 26 % ressemble à un écart. Avec n=12 contre n=27, on obtient p = 0,455, ce qui se situe confortablement dans la marge d'erreur d'un tirage à pile ou face. Ailleurs dans nos recherches, les données originales constituent un avantage réel. Sur cette question et avec cette taille d'échantillon, nous ne pouvons pas l'affirmer, donc nous ne l'affirmons pas.
Le format n'a pas fait la différence. 75 % contre 78 % pour les listicles. p = 1,000. Les pages citées sont majoritairement des listicles, quel que soit l'éditeur. Être un article de type « best-of » est le minimum requis, pas un avantage concurrentiel.
La signature de l'auteur n'a pas fait la différence. 42 % contre 44 %. p = 1,000. Une grande partie des conseils en SEO repose sur les signaux liés à l'auteur ou à l'E-E-A-T. Dans ces données, la présence d'un auteur nommé ne permet pas de distinguer une page de marque citée d'une page tierce citée. Ce n'est pas la preuve que cela n'a pas d'importance, c'est la preuve que nous n'avons pas mesuré son impact.
Et la longueur a joué en sens inverse. Les pages appartenant aux marques citées comptaient une médiane de 3 158 mots, contre 3 901 pour les pages tierces. Si la longueur était le levier principal, les pages publiées par les marques seraient plus longues, et non plus courtes.
Le site d'une agence a été cité près d'une fois sur deux. Le site d'une marque e-commerce a été cité une seule fois sur treize questions. Si cette tendance se confirme à plus grande échelle, cela vaut bien plus que toutes les tactiques on-page réunies dans ce rapport.
Mais nous devons être honnêtes avec vous : la différence entre agence et e-commerce est de p = 0,073. Ce n'est pas statistiquement significatif sur la base de 13 questions par catégorie. C'est le point le plus intéressant de cet ensemble de données et le meilleur argument pour mener une étude à plus grande échelle. C'est ce que nous sommes en train de faire.
Les blocs FAQ et les tableaux de données sont les seuls éléments qui distinguent significativement les pages de marque citées des pages tierces citées. Et ils ne coûtent rien.
Ils ont peut-être leur importance. Ils n'ont pas été mesurés comme tels ici, et nous n'allons pas prétendre le contraire.
Si vous vendez en DTC, votre propre blog a atteint 8 % dans cet échantillon — le placement sur des sites tiers est probablement une stratégie plus efficace. Si vous êtes une agence, votre propre site est une réelle opportunité.
Les pages de marque citées étaient plus courtes que les pages tierces citées. La longueur n'est pas le levier.
| Métrique | Portée | Valeur |
|---|---|---|
| Pages les plus citées analysées | Perplexity, 39 questions | 39 |
| Autopublié | Perplexity, 39 questions | 12 / 39 = 31 % |
| Tiers | Perplexity, 39 questions | 27 / 39 = 69 % |
| FAQ/tableaux — autopublié | n=12 | 9 = 75 % |
| FAQ/tableaux — tiers | n=27 | 6 = 22 % |
| FAQ/tableaux — significativité | Test de Fisher, bilatéral | p = 0,004 |
| Données originales — autopublication vs tiers | n=12 / n=27 | 42 % vs 26 % · p = 0,455 |
| Article de type liste — autopublication vs tiers | n=12 / n=27 | 75 % vs 78 % · p = 1,000 |
| Auteur nommé — autopublié vs tiers | n=12 / n=27 | 42 % vs 44 % · p = 1,000 |
| Nombre médian de mots — autopublié | n=12 | 3 158 |
| Nombre médian de mots — tiers | n=27 | 3 901 |
| Taux d'autopublication — agences | n=13 | 6 = 46 % |
| Taux d'autopublication — SaaS B2B | n=13 | 5 = 38 % |
| Taux d'autopublication — e-commerce | n=13 | 1 = 8 % |
| Agences vs e-commerce | Test de Fisher, bilatéral | p = 0,073 |
verify-numbers.py recalcule chaque chiffre ci-dessus directement à partir des fichiers CSV.Fondateur, HarperFlow
Diplômé de l'Université de Cambridge et médecin, il est devenu créateur de contenu : sa chaîne YouTube, NeuroEverything, compte plus de 40 000 abonnés et vulgarise les neurosciences. Il s'est ensuite orienté vers l'ingénierie de l'automatisation, concevant des pipelines de contenu pour les fondateurs et créateurs qui préfèrent bâtir plutôt que promouvoir. Il a lancé HarperFlow avec une conviction : les idées brillantes méritent d'être vues, et ceux qui excellent dans la création manquent souvent de temps pour les faire connaître. Il écrit depuis le terrain : HarperFlow teste ses propres pipelines sur son propre blog avant tout.
Oui — 12 des 39 pages les plus citées (31 %) étaient la propre page de la marque, et non un article de type « liste » tiers (Perplexity, juillet 2026).
La structure. Les pages de marque citées contenaient des blocs FAQ ou des tableaux de données dans 75 % des cas, contre 22 % pour les pages tierces citées — p=0,004, le seul trait significatif parmi les quatre que nous avons testés.
Pas de manière mesurable ici. Auteurs nommés : 42 % contre 44 % (p=1,000). Et les pages de marque citées étaient plus courtes que les pages tierces — médiane de 3 158 contre 3 901 mots — la longueur n'est donc pas le facteur déterminant.
La même méthode, appliquée à votre domaine. Nous poserons aux moteurs de recherche les questions de vos acheteurs et nous vous montrerons si vos pages — ou celles de vos concurrents — apparaissent en réponse.
Structurer le contenu de cette manière — blocs FAQ, tableaux, réponses claires — est exactement ce que fait le pipeline de publication de HarperFlow pour chaque article.
Lancer l'audit gratuit →