Guide

Comment utiliser une carte de fréquence des mots

Saisissez un texte, choisissez le filtrage, la longueur minimale et la limite d’affichage, puis lancez l’analyse. La liste obtenue classe les termes conservés par fréquence et fournit leur pourcentage ainsi que des statistiques arrondies.

Outil Fréquence des mots

À quoi sert l’analyse de fréquence des mots ?

Cette carte de fréquence sert à repérer les termes qui reviennent le plus souvent dans un texte. Elle peut aider à examiner un brouillon, un compte rendu ou un corpus court, à condition de tenir compte des filtres appliqués avant le comptage.

Le résultat porte sur les jetons de mots conservés, et non nécessairement sur chaque mot présent dans le texte d’origine. Le filtrage des mots vides est activé par défaut. Une longueur minimale est également appliquée, avec une valeur par défaut de 3 caractères. Ces choix influencent directement les termes visibles et les statistiques finales.

Comment lancer une analyse

  1. Préparez le passage à examiner. Saisissez ou collez un texte non vide dans la zone prévue à cet effet. Un texte facultatif peut aussi être laissé vide, mais l’analyse aboutira alors à un résultat sans entrée et avec des totaux nuls.

  2. Choisissez le filtrage des mots vides. Il est activé par défaut. Lorsqu’il reste actif, les termes appartenant à l’ensemble intégré de mots vides sont exclus après l’application de la longueur minimale. Désactivez ce réglage si vous souhaitez conserver ces termes dans le comptage.

  3. Ajustez la longueur minimale des termes si nécessaire. La valeur par défaut est de 3 caractères. La valeur fournie est convertie en entier, puis ramenée à au moins 1. Une valeur absente ou considérée comme fausse reprend la valeur 3.

  4. Définissez le nombre maximal de termes affichés. La limite par défaut est de 30. Elle est convertie en entier et reste comprise entre 5 et 100. Une valeur absente ou considérée comme fausse reprend la valeur 30.

  5. Lancez l’analyse, puis consultez la liste produite. Les termes conservés sont classés du plus fréquent au moins fréquent, dans la limite d’affichage choisie. Comparez les réglages utilisés avant de comparer deux résultats, car une modification du filtrage ou de la longueur minimale change le périmètre compté.

Comment lire le résultat

Chaque terme affiché est accompagné d’un pourcentage calculé parmi les jetons conservés. Ce pourcentage est arrondi à deux décimales. Une valeur de barre relative est aussi fournie, arrondie à une décimale. Le total des jetons conservés et le nombre de termes distincts permettent de situer la liste affichée dans l’ensemble analysé.

Une fréquence élevée indique qu’un terme apparaît souvent après les règles de conservation, mais ne suffit pas à établir l’importance du terme dans le texte. Si la limite d’affichage est inférieure au vocabulaire conservé, certains termes distincts ne figurent pas dans la liste. Pour une lecture comparable, gardez les mêmes réglages et vérifiez si les mots vides sont inclus ou exclus.

La normalisation transforme le texte en minuscules. Les caractères qui ne sont pas des lettres ASCII, des espaces ou des apostrophes sont remplacés par des espaces, puis le texte restant est séparé selon les espaces. Les chiffres, la ponctuation non conservée et les lettres accentuées peuvent donc modifier la forme des termes comptés. Les résultats doivent être lus comme une analyse normalisée, pas comme une transcription fidèle du texte original.

Exemple pratique

Vous examinez un court compte rendu sur des vélos afin d’identifier les termes répétés après les règles de filtrage.

Collez ce texte : « Les vélos rouges avancent vite. Les vélos restent visibles. » Laissez le filtrage par défaut, conservez la longueur minimale proposée et lancez l’analyse avec la limite d’affichage par défaut. Examinez ensuite le classement et les deux statistiques globales.

Le résultat prend la forme d’une liste de termes classés par fréquence, avec pour chaque terme un pourcentage arrondi à deux décimales et une barre relative arrondie à une décimale. Il inclut aussi le total des jetons conservés et le nombre de termes distincts. Comme les « é » sont remplacés par des espaces lors de la normalisation, « vélos » donne « v » (trop court) et « los » ; les termes les plus fréquents sont alors « les » et « los », chacun avec 2 occurrences.

Limites

  • Le résultat dépend de la normalisation, du filtrage des mots vides, de la longueur minimale et de la limite d’affichage. Les termes exclus ne contribuent pas aux statistiques, et une limite plus basse que le vocabulaire conservé masque une partie des termes distincts.

Erreurs fréquentes

  • Erreur : fournir une valeur non textuelle non vide au lieu d’un texte. Correction : saisissez ou collez un contenu textuel ; certaines valeurs non textuelles peuvent faire échouer le traitement au lieu de produire un résultat géré.

Questions fréquentes

Que se passe-t-il si je ne fournis aucun texte ?

Lorsque le texte est vide ou omis, l’analyse réussit avec zéro entrée de mot et des totaux nuls. Pour obtenir une fréquence exploitable, fournissez un contenu textuel.

Les mots vides sont-ils comptés ?

Les mots vides sont exclus lorsque le filtrage correspondant reste activé, après l’application de la longueur minimale. Désactivez ce filtrage si vous voulez les inclure dans le comptage.

Les accents, les chiffres et la ponctuation influencent-ils le résultat ?

Les lettres accentuées et les chiffres ne sont pas conservés comme tels dans la normalisation : les caractères qui ne sont pas des lettres ASCII, des espaces ou des apostrophes sont remplacés par des espaces. Le texte est aussi converti en minuscules avant la séparation des termes.

Outil

Fréquence des mots