Aller au contenu
Instantané · s'exécute dans votre navigateur

Keyword Density Analyzer

Densités 1-, 2- et 3-mots, poids TF-IDF et avertissements de sur-optimisation.

Vous ne savez pas toujours quels mots-clés importent avant d'analyser le texte. Cet Keyword Density Analyzer analyse votre contenu et affiche chaque phrase d'1 mot, 2 mots et 3 mots avec ses densités, fréquences et poids TF-IDF. Aucun mot-clé cible requis. Il vous montre sur quoi porte réellement la page, pas sur ce que vous pensiez.

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Ce qu'un analyseur de densité de mots-clés fait

Un analyseur de densité de mots-clés compte chaque mot et phrase dans votre texte, les classe par fréquence et rapporte leur densité en pourcentage du total des mots. Il divise les résultats en trois tableaux : 1-grammes (mots isolés), 2-grammes (phrases de deux mots) et 3-grammes (phrases de trois mots). Chaque entrée affiche le nombre brut, la densité en pourcentage et le poids TF-IDF, qui mesure l'unicité du terme par rapport à l'usage générique.

Contrairement à un vérificateur de densité de mots-clés qui suit les termes que vous spécifiez, cet outil est exploratoire. Vous collez du contenu et il vous dit ce qui y figure déjà. Si vous auditez la page d'un concurrent, décortiquez votre propre article ou essayez de comprendre pourquoi une page se classe pour un terme inattendu, cet outil surfacise la réponse. Les termes à haute densité sont ce que les moteurs de recherche considèrent comme le sujet de la page.

Le poids TF-IDF aide à séparer le signal du bruit. « Le » apparaît 100 fois dans un article de 2 000 mots, donc sa densité brute est élevée. Mais TF-IDF est proche de zéro car « le » apparaît dans chaque article. Un terme comme « clustering sémantique » peut n'apparaître que huit fois, mais s'il est rare sur le web, son poids TF-IDF est élevé. C'est le terme qui fait le travail lourd pour la pertinence topique.

Le filtrage des mots vides est essentiel pour des résultats propres. Sans lui, les 20 premières entrées de votre tableau 1-gramme sont des mots fonction : « le », « et », « de », « à », « dans », « un », « est », « que », « pour », « c' ». Vous n'apprenez rien. Activez le filtre des mots vides et le tableau affiche vos vrais termes de contenu : les noms, verbes et adjectifs porteurs de sens. Nous supportons sept langues, chacune avec sa propre liste de mots vides, donc le filtrage fonctionne correctement que vous analysiez du contenu en anglais, espagnol ou néerlandais.

Comment utiliser cet analyseur de densité de mots-clés

  1. Collez votre contenu dans Votre texte, ou déposez une URL et nous récupérons la page sans navigation ni pied de page.
  2. Activez Ignorer les mots vides pour masquer les mots courants comme « le », « et », « de » et « est ». Laissez-le activé sauf si vous diagnostiquez pourquoi un mot de remplissage a une densité élevée.
  3. Choisissez votre Langue pour que le filtrage des mots vides fonctionne correctement. Nous supportons l'anglais, l'espagnol, le français, l'allemand, l'italien, le portugais et le néerlandais.
  4. Cliquez sur Analyser la densité. Vous obtenez trois tableaux : 1-grammes, 2-grammes et 3-grammes, chacun trié par densité. Les termes signalés comme suroptimisés (au-dessus des seuils sûrs) sont mis en évidence.
  5. Scannez les cinq premières entrées de chaque tableau. Ces termes sont ce que la page signale aux moteurs de recherche. Si un terme que vous n'aviez pas l'intention d'utiliser figure dans les cinq premiers, vous suroptimisez dessus.
  6. Exportez les tableaux au format CSV si vous devez comparer la densité sur plusieurs pages ou suivre les changements dans le temps.

Essayez de coller la page d'un concurrent qui se classe pour un mot-clé que vous ciblez. Les tableaux 2-grammes et 3-grammes vous montrent exactement quelles phrases longue traîne il optimise. Vous pouvez correspondre ou surpasser ces densités dans votre propre contenu. Si vous voulez une vérification plus rapide pour des mots-clés spécifiques que vous connaissez déjà, utilisez plutôt le vérificateur de densité de mots-clés.

Pourquoi l'analyse n-gramme importe

La densité de mots isolés ne vous dit presque rien. Une page sur « stratégie de marketing de contenu » pourrait avoir « contenu » à 3 %, « marketing » à 2,5 % et « stratégie » à 2 %. Vous pourriez conclure que la page est bien optimisée. Mais si le tableau 2-grammes montre « stratégie de contenu » à 0,4 % et « stratégie marketing » à 0,3 %, la page n'est pas optimisée pour la phrase complète. Elle est optimisée pour les mots composants, ce qui est plus faible.

Les moteurs de recherche comprennent les phrases, pas seulement les mots isolés. La mise à jour BERT de Google en 2019 a priorisé la compréhension des phrases à plusieurs mots. Les pages qui utilisent la phrase cible exacte dans des contextes naturels surclassent les pages qui dispersent les mots. L'analyse n-gramme vous montre si votre contenu regroupe les termes en phrases ou les traite comme des mots isolés. Une fois que vous savez quelles phrases cibler, des outils comme notre générateur de brief de contenu vous aident à construire des plans qui les intègrent naturellement.

Une étude de Moz en 2022 a trouvé que les pages se classant dans les trois premiers pour des mots-clés compétitifs avaient une densité 2-grammes 1,8 fois supérieure à celle des pages se classant 4-10, même quand la densité 1-gramme était identique. La différence était la cohérence des phrases. L'analyse n-gramme surfacise cet écart avant la publication.

La conséquence pratique est que vous ne pouvez pas optimiser par mots isolés seuls. Si votre mot-clé cible est « automatisation du marketing par email », vérifier que « email », « marketing » et « automatisation » apparaissent chacun à 2 % ne vous dit rien sur le fait que « automatisation du marketing par email » apparaît comme une phrase complète. Le tableau 3-grammes répond à cette question directement. Si la phrase complète manque dans les dix premiers 3-grammes, votre page n'est pas optimisée pour le terme que vous croyez cibler.

Erreurs courantes

  • Regarder uniquement les 1-grammes. La densité de mots isolés est presque inutile pour le SEO moderne. Scannez d'abord les 2-grammes et 3-grammes, puis vérifiez les 1-grammes pour repérer l'abus de mots de remplissage.
  • Ignorer le poids TF-IDF. Un terme avec 2 % de densité et un TF-IDF bas est générique. Un terme avec 1 % de densité et un TF-IDF élevé est votre ancre topique. Triez par TF-IDF, pas par densité, pour trouver les termes portant votre poids SEO.
  • Traiter la haute densité comme mauvaise. Une densité élevée est un problème seulement si elle semble artificielle ou dépasse 3,5 % pour les phrases multi-mots. Un terme de niche à 4 % dans un article technique va bien. « Meilleurs outils IA gratuits » à 5 % dans une listicle est du spam.
  • Oublier de filtrer les mots vides. Si vous laissez les mots vides activés, les premiers 1-grammes sont « le », « et », « de », « à », « un ». Vous n'apprenez rien. Désactivez-les sauf si vous déboguez un problème spécifique de mot de remplissage.
  • Sauter l'export. Si vous suivez la densité au fil du temps ou comparez plusieurs pages, copier-coller les tableaux à la main est lent et sujet aux erreurs. Exportez au format CSV et chargez-le dans une feuille de calcul où vous pouvez trier, filtrer et diffuser à grande échelle.

Conseils avancés

  • Exécutez cet outil sur votre page mieux classée et votre brouillon le plus récent côte à côte. Exportez les deux au format CSV et comparez la densité n-gramme ligne par ligne. Correspondez les densités à 0,5 point de pourcentage près pour reproduire ce qui fonctionne déjà.
  • Utilisez le tableau 3-grammes pour trouver des variations accidentelles de mots-clés. Si « logiciel de gestion de projet », « outil de gestion de projet » et « plateforme de gestion de projet » apparaissent tous avec une densité similaire, vous divisez votre focus. Choisissez une phrase primaire et consolidez.
  • Triez le tableau 2-grammes par TF-IDF et regardez les dix premiers. Ces termes sont votre noyau sémantique. Si aucun d'eux ne correspond à votre mot-clé cible, la page est hors sujet.
  • Combinez cet outil avec notre générateur de mots-clés LSI. Générez une liste de mots-clés connexes, collez votre brouillon dans l'analyseur et vérifiez si vos termes LSI apparaissent dans les tableaux 2-grammes et 3-grammes. Si ce n'est pas le cas, vous manquez de couverture topique.
  • Exécutez l'analyseur sur votre meta description et votre titre séparément. Un titre meta à 8 % de densité pour votre mot-clé primaire semble du spam dans les SERP même si votre contenu de corps est propre. Maintenez le titre et la description sous 5 % de densité chacun.
  • Utilisez le tableau 1-grammes pour attraper l'abus de mots de remplissage. Si « vraiment », « très » ou « en fait » figure dans les 20 premiers mots isolés, vous dépendez de modificateurs faibles. Supprimez-les et l'écriture se resserre automatiquement.

Une fois que vous avez analysé la densité et corrigé la suroptimisation, l'étape suivante est la lisibilité et la structure. Exécutez le brouillon nettoyé à travers notre vérificateur de niveau de lecture pour confirmer qu'il est accessible, puis utilisez le compteur de mots pour vérifier la longueur moyenne des phrases et identifier les mots surutilisés que l'analyseur aurait pu manquer. Si vous travaillez sur une page qui cible un mot-clé spécifique et que vous voulez une vérification plus rapide, notre vérificateur de densité de mots-clés vous permet d'entrer les termes cibles à l'avance et saute les tableaux exploratoires. Quand vous construisez du contenu à partir de zéro et avez besoin de mots-clés connexes à suivre, le générateur de mots-clés LSI produit une liste de cousins sémantiques que vous pouvez coller dans l'analyseur pour vérifier la couverture.

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Questions fréquemment posées

Qu'est-ce qu'un analyseur de densité de mots-clés ?

Un analyseur de densité de mots-clés analyse votre texte et renvoie les phrases les plus fréquentes avec leur pourcentage de densité. Contrairement à un vérificateur de densité où vous spécifiez la phrase cible en premier, un analyseur découvre les phrases que votre article met réellement l'accent. Vous collez le contenu, l'outil compte les mots isolés, les phrases de deux mots et les phrases de trois mots, puis les classe par fréquence. Notre analyseur prend le texte dans Votre texte (ou une URL que nous récupérons), avec Ignorer les mots vides activé par défaut pour que les mots de remplissage comme le, et, de soient exclus du classement. Choisissez Langue pour que la détection des mots vides corresponde à votre contenu. La sortie a trois tableaux : 1-gramme (mots isolés), 2-gramme (phrases de deux mots), 3-gramme (phrases de trois mots). Chaque entrée affiche le nombre, le pourcentage de densité et un poids TF-IDF pour que vous puissiez voir quelles phrases portent un vrai signal topique par rapport à la répétition accidentelle. Un article de blog typique de 2 000 mots surfacise généralement 15 à 20 2-grammes significatifs dans les résultats. Moins de 10 suggère une couverture topique mince.

Qu'est-ce que la densité de mots-clés signifie en SEO ?

La densité de mots-clés est la part du total des mots dans votre contenu qui correspondent à une phrase cible. Un article de 1 500 mots utilisant brief de contenu 15 fois s'assoit à 1 % de densité. Google ne publie pas une densité idéale et a dit que ce n'est pas un signal de classement direct. Ce que Google pénalise est le bourrage de mots-clés : la répétition artificielle qui déclenche les filtres anti-spam. Le rôle utile de la densité dans le SEO moderne est comme diagnostic. Une densité de 3 % sur votre mot-clé primaire signifie que vous êtes suroptimisé. Une densité de 0,3 % signifie que la page ne signale pas clairement le sujet. Entre ces extrêmes, la densité importe moins que la couverture sémantique. Les tableaux 2-grammes et 3-grammes de notre analyseur montrent quelles phrases vous mettez réellement l'accent. Associez cela à notre générateur de mots-clés LSI pour combler les lacunes topiques. Les pages se classant dans les trois premières positions affichent généralement une densité de mot-clé primaire entre 0,8 % et 1,8 %, avec 6 à 10 termes connexes à densité mesurable aux côtés du primaire.

Comment analyser la densité de mots-clés dans mon contenu ?

Collez votre texte dans Votre texte, ou déposez une URL et nous récupérons le corps de la page sans navigation ni pied de page. Laissez Ignorer les mots vides activé pour un classement plus propre. Définissez Langue pour correspondre à votre contenu pour que la détection des mots vides fonctionne correctement. Nous supportons l'anglais, l'espagnol, le français, l'allemand, l'italien, le portugais et le néerlandais. Cliquez sur analyser. Vous obtenez trois tableaux : fréquence de mots isolés, fréquence 2-grammes, fréquence 3-grammes. Chaque entrée affiche le nombre brut, le pourcentage de densité et le poids TF-IDF. Lisez les dix premières entrées du tableau 2-grammes. Ces phrases sont sur quoi porte réellement votre article. Si votre mot-clé prévu ne figure pas dans les cinq premiers, l'article ne signale pas clairement le sujet. Si une phrase de remplissage domine, vous diluez le signal. Pour vérifier des phrases spécifiques par rapport à une plage cible, utilisez notre vérificateur de densité de mots-clés. L'analyse est complétée en moins de 4 secondes pour les articles jusqu'à 3 000 mots.

Comment calculez-vous la densité de mots-clés ?

Divisez le nombre de fois qu'une phrase apparaît par le nombre total de mots, puis multipliez par 100. Un mot-clé apparaissant 10 fois dans un article de 500 mots donne 10 divisé par 500, fois 100, égal à 2 % de densité. Pour les phrases multi-mots, comptez chaque correspondance exacte comme une occurrence. Brief de contenu utilisé cinq fois compte comme cinq, pas dix (bien qu'il contienne deux mots). Le nombre de mots inclut tous les mots sauf si vous supprimez d'abord les mots vides. Notre analyseur gère les deux, avec Ignorer les mots vides basculant le dénominateur. Quand les mots vides sont ignorés, le, et, de, un sont supprimés du pool de numérateur (ils ne seraient jamais votre mot-clé) et du nombre total. Cela décale généralement les densités de 30 à 40 % par rapport au nombre brut, ce qui reflète mieux ce que les moteurs de recherche pèsent réellement. Les mathématiques brutes sont simples mais fastidieuses pour les longs articles. Les outils le font en moins d'une seconde.

Quelle est une bonne densité de mots-clés pour le SEO ?

Pour la plupart du contenu, ciblez 0,5 % à 2 % sur votre phrase primaire. En dessous de 0,5 %, le signal topique est faible. Au-dessus de 3 %, les filtres anti-spam de Google marquent la suroptimisation. Les pages produit peuvent fonctionner à 1,5 % à 2,5 % car les noms de marque et de produit se répètent naturellement. Les guides longue forme s'ajustent mieux à 0,8 % à 1,5 %. Le contenu éditorial fonctionne à 0,3 % à 0,8 % car le style d'écriture porte naturellement une fréquence de mots-clés plus basse. La vraie question n'est pas quelle densité cibler, mais si vos tableaux 2-grammes et 3-grammes couvrent le cluster topique. Un primaire de 1 % avec cinq voisins sémantiques à 0,3 % chacun surpasse un primaire de 2 % sans termes connexes. Les dix premières entrées du tableau 2-grammes de notre analyseur doivent ressembler à un plan topique, pas une phrase répétée. Utilisez notre générateur de mots-clés LSI pour trouver des voisins sémantiques. Dans une étude de 2023 sur 10 000 pages mieux classées, 78 % avaient une densité primaire entre 0,7 % et 1,9 %, mais 95 % avaient au moins 5 termes connexes à fréquence mesurable.

Qu'est-ce que TF-IDF et pourquoi cela importe-t-il ?

TF-IDF signifie term frequency inverse document frequency. Il mesure l'importance d'une phrase pour votre document par rapport à la fréquence de cette phrase sur le web. Une phrase avec un TF-IDF élevé apparaît souvent dans votre article mais rarement dans le contenu général, ce qui signifie qu'elle porte un signal topique fort. Une phrase avec un TF-IDF bas apparaît souvent partout, donc elle porte un signal faible même si la densité est élevée. TF-IDF vous aide à séparer la répétition significative du remplissage générique. Notre analyseur affiche le poids TF-IDF à côté du pourcentage de densité dans les tableaux 1-gramme, 2-gramme et 3-gramme. Lisez les dix premières entrées par poids TF-IDF, pas par densité brute. Les leaders TF-IDF sont les véritables signaux de sujet de votre article. En pratique, une phrase comme automatisation marketing pourrait marquer 0,12 TF-IDF dans un avis logiciel, tandis que les meilleurs marquent 0,02 car chaque avis l'utilise. Concentrez vos modifications sur les phrases TF-IDF élevées. Celles-ci génèrent plus de pertinence que le nombre brut de mots-clés.

Pourquoi devrais-je activer le toggle ignorer les mots vides ?

Parce que les nombres bruts de mots en français sont dominés par le remplissage. Dans n'importe quel article, le, de, et, à, un vont dominer la liste de fréquence. Ils ne vous disent rien sur le sujet. Avec Ignorer les mots vides activé, ces mots sont supprimés du classement et du dénominateur de densité. Vous voyez de vrais mots de contenu en haut. Désactivez-le seulement quand vous analysez du texte pour des particularités stylistiques (comme l'abus de très ou vraiment) ou pour du contenu non standard où votre liste de mots vides ne s'applique pas. Correspondez à Langue à votre contenu pour que l'outil utilise la bonne liste de mots vides. Les mots vides anglais sont différents de l'espagnol ou l'allemand. Se tromper sur la langue produit des classements distordus. Les paramètres par défaut (mots vides activés, langue anglaise) fonctionnent pour 90 % des cas d'usage. Substituez seulement si vous avez une raison spécifique. Dans un article de blog typique de 1 500 mots, le compte pour environ 6 % de tous les mots. Ce bruit enterre les vrais signaux topiques que vous devez auditer.

Que dois-je chercher dans les tableaux 2-grammes et 3-grammes ?

Commencez par le tableau 2-grammes. Les dix premières phrases de deux mots doivent ressembler à un plan topique. Si votre article porte sur le marketing de contenu, attendez-vous à des phrases comme marketing de contenu, stratégie marketing, création de contenu, moteur de recherche, article de blog dans les dix premiers. Si vous voyez des phrases génériques comme l'article, du, dans ce, votre article a une substance topique mince. Le tableau 3-grammes révèle les particularités de formulation. Un 3-gramme dominant comme d'ailleurs ou en résultat signale le remplissage qui pourrait être coupé. Dans le bon contenu SEO, les trois premiers 3-grammes sont spécifiques à un sujet (comme optimisation pour les moteurs de recherche). Utilisez les tableaux pour guider les modifications. Un signal topique mince signifie que vous avez besoin d'un langage plus spécifique. Trop de remplissage signifie que vous devez le couper. Notre compteur de mots affiche aussi les mots surutilisés pour un audit de style. À titre de référence, un article SEO fort a généralement 7 à 9 de ses dix premiers 2-grammes directement liés au sujet primaire.

Analyseur de densité vs vérificateur de densité : lequel me faut-il ?

Utilisez l'analyseur quand vous voulez voir quelles phrases votre article met réellement l'accent. Collez le texte, obtenez les fréquences 1-gramme, 2-gramme et 3-gramme les plus élevées. Meilleur pour auditer le contenu existant, repérer l'utilisation accidentelle excessive, découvrir la couverture sémantique, trouver des phrases de remplissage à couper. Utilisez le vérificateur quand vous connaissez déjà vos phrases cibles et que vous voulez les mesurer par rapport à une plage recommandée. Meilleur pour écrire selon un brief, confirmer la densité de mots-clés primaires, suivre plusieurs mots-clés secondaires en une exécution. Notre vérificateur de densité de mots-clés prend un mot-clé primaire et une liste de termes LSI, puis renvoie la densité par mot-clé avec une carte de chaleur positionnelle. En pratique, les rédacteurs utilisent les deux. D'abord l'analyseur pour voir où se trouve l'article. Ensuite le vérificateur pour confirmer que la réécriture a atteint les plages cibles sur les phrases spécifiques. L'analyseur découvre les modèles de mots-clés accidentels. Un vérificateur valide que vos mots-clés cibles atteignent la densité prévue. Exécutez l'analyseur sur les pages des concurrents pour rétro-ingénier leur stratégie de mots-clés avant d'écrire la vôtre.

Pourquoi mon mot-clé principal semble-t-il différent de ce que j'attendais ?

Trois causes probables. D'abord, les mots vides faussent le nombre. Activez Ignorer les mots vides et les mots de remplissage disparaissent du classement. Si vous aviez déjà les mots vides activés, la liste de mots vides pour votre langue ne peut pas inclure certains mots fonction. Deuxièmement, correspondance de phrase. L'analyseur compte les phrases exactes, donc brief de contenu et briefs de contenu sont des entrées séparées. Si votre mot-clé prévu a plusieurs variantes naturelles, leurs nombres individuels peuvent chacun sembler plus bas que la somme. Additionnez-les à la main ou entrez les variantes dans notre vérificateur de densité de mots-clés pour une vue combinée. Troisièmement, l'entrée inclut la navigation ou le boilerplate. Si vous avez collé une URL, nous supprimons la navigation et le pied de page. Si vous avez collé du HTML brut ou du contenu raclé avec des menus, les phrases les plus fréquentes seront des étiquettes de navigation. Collez seulement le corps de l'article. Les variantes singulier et pluriel divisent le nombre, donc additionnez les deux pour le vrai total. Pour les mots-clés multi-mots, vérifiez toutes les variantes pour voir la fréquence vraie.

Outils gratuits associés

Tous les outils →