Inspecteur Unicode
Inspectez chaque caractère de votre texte : points de code, notation hexadécimale, octets d'encodage UTF-8 et catégories générales.
Exécuter l’outil
Inspecter une chaîne de caractères caractère par caractère facilite l'identification précise des points de code, de la structure binaire et des octets d'encodage. Cet outil en ligne gratuit analyse le texte saisi et décompose chaque élément individuel selon son point de code numérique et sa notation hexadécimale en majuscules. Il affiche également la séquence d'octets correspondante au format UTF-8 en hexadécimal, la position dans la chaîne et une étiquette de catégorie basée sur des plages numériques de points de code. L'analyse détaille le décompte total des caractères traités ainsi que le total des octets UTF-8 consommés. Que vous inspectiez des symboles ASCII simples, des caractères accentués, des idéogrammes CJK ou des symboles spéciaux, l'outil fournit une décomposition directe sans configuration complexe. En cas de champ vide, le récapitulatif affiche simplement un total de zéro caractère et zéro octet UTF-8.
Mode d’emploi
- Saisissez ou collez votre texte dans la zone de texte prévue.
- Lancez l'inspection pour déclencher l'analyse caractère par caractère.
- Examinez la liste détaillée affichant pour chaque caractère sa position, son point de code, ses octets UTF-8 et sa catégorie.
- Consultez les totaux généraux indiquant le nombre de caractères et le volume d'octets UTF-8 générés.
Exemples
- Pour le mot « Café », l'outil décompose les quatre caractères, indique le point de code U+00E9 pour la lettre « é » encodée sur deux octets UTF-8 (C3 A9), et affiche un total de 5 octets UTF-8.
- Pour le symbole monétaire « € », l'outil relève le point de code U+20AC, présente les 3 octets UTF-8 associés (E2 82 AC) et comptabilise 1 caractère pour 3 octets.
FAQ
Comment sont attribuées les catégories de caractères ?
Les étiquettes de catégorie sont déterminées à partir de plages numériques larges de points de code. Elles constituent un repère informatif global et non une classification officielle issue des propriétés normées du standard Unicode.
Que se passe-t-il si aucun texte n'est renseigné ?
Si le champ reste vide ou est omis, l'analyse s'exécute normalement et indique un total de zéro caractère ainsi que zéro octet UTF-8.
L'outil gère-t-il les graphèmes complexes comme une seule unité ?
L'inspection suit l'itération directe des caractères dans la chaîne de texte sans regrouper les séquences de graphèmes visuels ni effectuer de normalisation particulière.