Guide

Comment utiliser l’analyseur de fréquence des mots

Collez votre texte, choisissez le filtrage des mots vides et le nombre de résultats, puis lancez l’analyse pour consulter les fréquences, pourcentages et barres relatives. Pour un texte français, tenez compte de la règle qui reconnaît les lettres ASCII et les apostrophes.

Outil Analyseur de fréquence des mots

À quoi sert l’analyseur de fréquence des mots ?

L’analyseur de fréquence des mots sert à repérer les termes qui reviennent le plus souvent dans un texte. Il peut être utile pour examiner un brouillon, comparer le vocabulaire de plusieurs passages ou obtenir une première vue d’ensemble avant une révision. Le résultat associe aux mots retenus un nombre d’occurrences, un pourcentage relatif et une mesure de barre proportionnelle.

Le texte saisi est converti en minuscules avant l’extraction. Seuls les éléments formés de lettres ASCII de a à z et d’apostrophes sont reconnus comme des tokens. Cette règle mérite une attention particulière pour un texte en français, car les lettres accentuées, les chiffres, la ponctuation et les mots avec trait d’union ne sont pas pris en charge comme des mots entiers selon ce mode d’extraction.

Comment analyser un texte

  1. Préparez le passage à examiner et collez-le dans le champ de texte. Le texte est facultatif : si vous ne fournissez rien, l’analyse réussit avec zéro mot au total et zéro mot unique.

  2. Décidez si vous souhaitez conserver le filtrage des mots vides. Il est activé par défaut. Lorsqu’il reste activé, les mots présents dans l’ensemble intégré de mots vides ne sont pas inclus dans les fréquences comptées. Désactivez cette option si vous devez observer aussi ces mots.

  3. Réglez le nombre de résultats à afficher si le réglage est disponible. La valeur par défaut est 20. Une valeur convertible en nombre entier est ramenée dans une plage allant de 5 à 100 ; une valeur invalide ou non renseignée revient à 20.

  4. Lancez l’analyse. Pour chaque token conservé, l’outil compte les occurrences et classe les entrées de la fréquence la plus élevée à la plus faible. Vérifiez la liste obtenue avant d’en tirer une conclusion sur le vocabulaire du passage.

  5. Lisez les deux indicateurs complémentaires. Le pourcentage correspond au nombre d’occurrences du mot divisé par le total des tokens extraits, puis arrondi à deux décimales. La barre relative compare le nombre du mot à la fréquence conservée la plus élevée et est arrondie à une décimale.

Comment lire les résultats

Une fréquence élevée signifie qu’un token apparaît souvent dans les éléments extraits, mais elle ne décrit pas à elle seule le sujet, la qualité ou la pertinence du texte. Le pourcentage aide à rapporter une fréquence au volume total des tokens extraits. La barre facilite une comparaison visuelle avec l’entrée conservée la plus fréquente ; elle ne représente pas une proportion indépendante du maximum.

Interprétez donc les résultats en tenant compte du filtrage choisi et de la forme du texte. Avec le filtrage activé, les mots vides disparaissent des fréquences, tandis que le dénominateur du pourcentage repose sur le total des tokens extraits. Pour une analyse française, contrôlez aussi les effets possibles des accents, des apostrophes, des nombres et des traits d’union sur l’extraction.

Exemple pratique

Vous examinez le vocabulaire récurrent d’un paragraphe de présentation afin de repérer les termes à vérifier avant une révision.

Collez un court passage contenant plusieurs répétitions de quelques termes, laissez le filtrage des mots vides activé, puis consultez la liste produite.

Le résultat présente une liste d’entrées classées par fréquence, avec pour chaque token conservé un nombre d’occurrences, un pourcentage arrondi à deux décimales et une barre relative arrondie à une décimale.

Limites

  • L’extraction ne traite pas les lettres non ASCII, les chiffres, la ponctuation ou les mots avec trait d’union comme des tokens entiers ; les résultats peuvent donc différer d’un comptage linguistique du français.

Erreurs fréquentes

  • Si des mots accentués, des nombres ou des formes avec trait d’union semblent absents ou découpés, vérifiez la règle d’extraction : seuls les tokens composés de lettres ASCII a à z et d’apostrophes sont reconnus.

Questions fréquentes

Que se passe-t-il si je ne saisis aucun texte ?

Si vous laissez le champ vide, l’analyse s’exécute avec succès et affiche zéro mot au total et zéro mot unique. Avec un texte fourni, les mots sont convertis en minuscules avant l’extraction.

Les mots vides sont-ils comptés ?

Le filtrage est activé par défaut. Lorsqu’il est activé, les mots présents dans l’ensemble intégré de mots vides sont exclus des fréquences comptées ; désactivez-le pour les inclure dans l’analyse.

Combien de mots puis-je afficher ?

Le réglage commence à 20. Une valeur convertible en entier est limitée entre 5 et 100, tandis qu’une valeur invalide ou non renseignée revient à 20.

Outil

Analyseur de fréquence des mots