Ce qu'un analyseur de densité de mots-clés fait
Un analyseur de densité de mots-clés compte chaque mot et phrase dans votre texte, les classe par fréquence et rapporte leur densité en pourcentage du total des mots. Il divise les résultats en trois tableaux : 1-grammes (mots isolés), 2-grammes (phrases de deux mots) et 3-grammes (phrases de trois mots). Chaque entrée affiche le nombre brut, la densité en pourcentage et le poids TF-IDF, qui mesure l'unicité du terme par rapport à l'usage générique.
Contrairement à un vérificateur de densité de mots-clés qui suit les termes que vous spécifiez, cet outil est exploratoire. Vous collez du contenu et il vous dit ce qui y figure déjà. Si vous auditez la page d'un concurrent, décortiquez votre propre article ou essayez de comprendre pourquoi une page se classe pour un terme inattendu, cet outil surfacise la réponse. Les termes à haute densité sont ce que les moteurs de recherche considèrent comme le sujet de la page.
Le poids TF-IDF aide à séparer le signal du bruit. « Le » apparaît 100 fois dans un article de 2 000 mots, donc sa densité brute est élevée. Mais TF-IDF est proche de zéro car « le » apparaît dans chaque article. Un terme comme « clustering sémantique » peut n'apparaître que huit fois, mais s'il est rare sur le web, son poids TF-IDF est élevé. C'est le terme qui fait le travail lourd pour la pertinence topique.
Le filtrage des mots vides est essentiel pour des résultats propres. Sans lui, les 20 premières entrées de votre tableau 1-gramme sont des mots fonction : « le », « et », « de », « à », « dans », « un », « est », « que », « pour », « c' ». Vous n'apprenez rien. Activez le filtre des mots vides et le tableau affiche vos vrais termes de contenu : les noms, verbes et adjectifs porteurs de sens. Nous supportons sept langues, chacune avec sa propre liste de mots vides, donc le filtrage fonctionne correctement que vous analysiez du contenu en anglais, espagnol ou néerlandais.
Comment utiliser cet analyseur de densité de mots-clés
- Collez votre contenu dans Votre texte, ou déposez une URL et nous récupérons la page sans navigation ni pied de page.
- Activez Ignorer les mots vides pour masquer les mots courants comme « le », « et », « de » et « est ». Laissez-le activé sauf si vous diagnostiquez pourquoi un mot de remplissage a une densité élevée.
- Choisissez votre Langue pour que le filtrage des mots vides fonctionne correctement. Nous supportons l'anglais, l'espagnol, le français, l'allemand, l'italien, le portugais et le néerlandais.
- Cliquez sur Analyser la densité. Vous obtenez trois tableaux : 1-grammes, 2-grammes et 3-grammes, chacun trié par densité. Les termes signalés comme suroptimisés (au-dessus des seuils sûrs) sont mis en évidence.
- Scannez les cinq premières entrées de chaque tableau. Ces termes sont ce que la page signale aux moteurs de recherche. Si un terme que vous n'aviez pas l'intention d'utiliser figure dans les cinq premiers, vous suroptimisez dessus.
- Exportez les tableaux au format CSV si vous devez comparer la densité sur plusieurs pages ou suivre les changements dans le temps.
Essayez de coller la page d'un concurrent qui se classe pour un mot-clé que vous ciblez. Les tableaux 2-grammes et 3-grammes vous montrent exactement quelles phrases longue traîne il optimise. Vous pouvez correspondre ou surpasser ces densités dans votre propre contenu. Si vous voulez une vérification plus rapide pour des mots-clés spécifiques que vous connaissez déjà, utilisez plutôt le vérificateur de densité de mots-clés.
Pourquoi l'analyse n-gramme importe
La densité de mots isolés ne vous dit presque rien. Une page sur « stratégie de marketing de contenu » pourrait avoir « contenu » à 3 %, « marketing » à 2,5 % et « stratégie » à 2 %. Vous pourriez conclure que la page est bien optimisée. Mais si le tableau 2-grammes montre « stratégie de contenu » à 0,4 % et « stratégie marketing » à 0,3 %, la page n'est pas optimisée pour la phrase complète. Elle est optimisée pour les mots composants, ce qui est plus faible.
Les moteurs de recherche comprennent les phrases, pas seulement les mots isolés. La mise à jour BERT de Google en 2019 a priorisé la compréhension des phrases à plusieurs mots. Les pages qui utilisent la phrase cible exacte dans des contextes naturels surclassent les pages qui dispersent les mots. L'analyse n-gramme vous montre si votre contenu regroupe les termes en phrases ou les traite comme des mots isolés. Une fois que vous savez quelles phrases cibler, des outils comme notre générateur de brief de contenu vous aident à construire des plans qui les intègrent naturellement.
Une étude de Moz en 2022 a trouvé que les pages se classant dans les trois premiers pour des mots-clés compétitifs avaient une densité 2-grammes 1,8 fois supérieure à celle des pages se classant 4-10, même quand la densité 1-gramme était identique. La différence était la cohérence des phrases. L'analyse n-gramme surfacise cet écart avant la publication.
La conséquence pratique est que vous ne pouvez pas optimiser par mots isolés seuls. Si votre mot-clé cible est « automatisation du marketing par email », vérifier que « email », « marketing » et « automatisation » apparaissent chacun à 2 % ne vous dit rien sur le fait que « automatisation du marketing par email » apparaît comme une phrase complète. Le tableau 3-grammes répond à cette question directement. Si la phrase complète manque dans les dix premiers 3-grammes, votre page n'est pas optimisée pour le terme que vous croyez cibler.
Erreurs courantes
- Regarder uniquement les 1-grammes. La densité de mots isolés est presque inutile pour le SEO moderne. Scannez d'abord les 2-grammes et 3-grammes, puis vérifiez les 1-grammes pour repérer l'abus de mots de remplissage.
- Ignorer le poids TF-IDF. Un terme avec 2 % de densité et un TF-IDF bas est générique. Un terme avec 1 % de densité et un TF-IDF élevé est votre ancre topique. Triez par TF-IDF, pas par densité, pour trouver les termes portant votre poids SEO.
- Traiter la haute densité comme mauvaise. Une densité élevée est un problème seulement si elle semble artificielle ou dépasse 3,5 % pour les phrases multi-mots. Un terme de niche à 4 % dans un article technique va bien. « Meilleurs outils IA gratuits » à 5 % dans une listicle est du spam.
- Oublier de filtrer les mots vides. Si vous laissez les mots vides activés, les premiers 1-grammes sont « le », « et », « de », « à », « un ». Vous n'apprenez rien. Désactivez-les sauf si vous déboguez un problème spécifique de mot de remplissage.
- Sauter l'export. Si vous suivez la densité au fil du temps ou comparez plusieurs pages, copier-coller les tableaux à la main est lent et sujet aux erreurs. Exportez au format CSV et chargez-le dans une feuille de calcul où vous pouvez trier, filtrer et diffuser à grande échelle.
Conseils avancés
- Exécutez cet outil sur votre page mieux classée et votre brouillon le plus récent côte à côte. Exportez les deux au format CSV et comparez la densité n-gramme ligne par ligne. Correspondez les densités à 0,5 point de pourcentage près pour reproduire ce qui fonctionne déjà.
- Utilisez le tableau 3-grammes pour trouver des variations accidentelles de mots-clés. Si « logiciel de gestion de projet », « outil de gestion de projet » et « plateforme de gestion de projet » apparaissent tous avec une densité similaire, vous divisez votre focus. Choisissez une phrase primaire et consolidez.
- Triez le tableau 2-grammes par TF-IDF et regardez les dix premiers. Ces termes sont votre noyau sémantique. Si aucun d'eux ne correspond à votre mot-clé cible, la page est hors sujet.
- Combinez cet outil avec notre générateur de mots-clés LSI. Générez une liste de mots-clés connexes, collez votre brouillon dans l'analyseur et vérifiez si vos termes LSI apparaissent dans les tableaux 2-grammes et 3-grammes. Si ce n'est pas le cas, vous manquez de couverture topique.
- Exécutez l'analyseur sur votre meta description et votre titre séparément. Un titre meta à 8 % de densité pour votre mot-clé primaire semble du spam dans les SERP même si votre contenu de corps est propre. Maintenez le titre et la description sous 5 % de densité chacun.
- Utilisez le tableau 1-grammes pour attraper l'abus de mots de remplissage. Si « vraiment », « très » ou « en fait » figure dans les 20 premiers mots isolés, vous dépendez de modificateurs faibles. Supprimez-les et l'écriture se resserre automatiquement.
Une fois que vous avez analysé la densité et corrigé la suroptimisation, l'étape suivante est la lisibilité et la structure. Exécutez le brouillon nettoyé à travers notre vérificateur de niveau de lecture pour confirmer qu'il est accessible, puis utilisez le compteur de mots pour vérifier la longueur moyenne des phrases et identifier les mots surutilisés que l'analyseur aurait pu manquer. Si vous travaillez sur une page qui cible un mot-clé spécifique et que vous voulez une vérification plus rapide, notre vérificateur de densité de mots-clés vous permet d'entrer les termes cibles à l'avance et saute les tableaux exploratoires. Quand vous construisez du contenu à partir de zéro et avez besoin de mots-clés connexes à suivre, le générateur de mots-clés LSI produit une liste de cousins sémantiques que vous pouvez coller dans l'analyseur pour vérifier la couverture.