Guide

Comment masquer du texte sensible dans un PDF

Fournissez un PDF valide encodé en base64, saisissez une chaîne de recherche non vide, puis lancez le masquage des correspondances textuelles. Le résultat renvoie un PDF traité avec les compteurs de pages et d’occurrences.

Outil Caviarder un PDF

Utilité du masquage textuel

Le masquage de texte dans un PDF permet de retirer les passages correspondant à une chaîne recherchée dans le texte des pages. Il peut servir à préparer un contrat, un formulaire ou un autre document avant sa diffusion, lorsque vous connaissez le nom, l’adresse ou la référence à traiter.

Le fichier d’entrée attendu est un PDF fourni sous forme de contenu encodé en base64. Après décodage, ses octets doivent commencer par la signature d’un PDF. La recherche porte sur le texte disponible dans chaque page, et non sur l’apparence générale du document. Un passage visible dans une image ne sera donc pas repéré par cette recherche textuelle.

Vous pouvez aussi fournir un remplacement composé de caractères ASCII pour l’annotation associée aux zones masquées. Si cette valeur n’est pas renseignée, le traitement applique sa valeur prévue par défaut. Une valeur non ASCII n’est pas fournie comme texte d’annotation de remplacement, ce qui rend les caractères ASCII appropriés pour ce champ.

Préparer la recherche et traiter le PDF

  1. Préparez le document. Utilisez un PDF valide, puis fournissez son contenu encodé en base64. Vérifiez que le contenu décodé commence par la signature d’un PDF. Une entrée absente, mal encodée ou ne correspondant pas à un PDF provoque l’échec du traitement.

  2. Saisissez le texte à rechercher. Cette valeur doit être non vide, car une recherche vide fait échouer l’opération avant le traitement du document. Reprenez une chaîne présente dans le texte sélectionnable d’une page et tenez compte de la façon dont le fichier conserve les espaces, les retours ou la séparation des mots.

  3. Définissez le remplacement si vous en avez besoin. Utilisez des caractères ASCII lorsque vous souhaitez fournir un texte d’annotation associé au masquage. Si vous ne renseignez rien, la valeur prévue par défaut est utilisée. Une valeur non ASCII n’est pas transmise comme texte d’annotation.

  4. Lancez l’opération, puis récupérez le résultat. Lorsqu’elle réussit, elle renvoie un PDF encodé en base64 dans lequel les passages correspondants ont été retirés au moyen de masquages appliqués. Le résultat fournit également le nombre de pages traitées et le nombre d’occurrences trouvées.

  5. Décodez le PDF renvoyé et examinez les zones visées. Comparez votre vérification avec les compteurs fournis, notamment si la chaîne peut apparaître plusieurs fois. Ce contrôle aide à repérer une recherche trop large ou une formulation qui ne correspond pas à la couche textuelle du fichier.

Interpréter le fichier et les compteurs

Le compteur d’occurrences indique le nombre de correspondances trouvées pour la chaîne fournie. Le compteur de pages indique le nombre de pages prises en charge par l’opération réussie. Si aucune occurrence n’est signalée, cela signifie que cette chaîne n’a pas été trouvée dans le texte de page examiné, sans permettre de conclure que l’information est absente de l’image affichée.

Le résultat contient un PDF encodé en base64 dont les régions correspondant au texte recherché ont fait l’objet de masquages appliqués. Il ne s’agit donc pas seulement d’un élément graphique placé par-dessus le contenu initial. Lorsque le document comporte plusieurs correspondances, ouvrez le fichier décodé et rapprochez les zones concernées du nombre renvoyé.

La couverture dépend de la couche textuelle du PDF. Un mot visible uniquement dans une image, ou un contenu qui nécessiterait une reconnaissance optique des caractères, ne sera pas pris en compte. Une différence entre la chaîne saisie et la structure interne du document peut également empêcher une correspondance. Vérifiez alors le texte sélectionnable et adaptez la recherche au contenu réellement conservé dans les pages.

Exemple pratique

Vous préparez un contrat PDF avant de le transmettre à un tiers et souhaitez masquer l’adresse e-mail du fournisseur dans les pages où elle apparaît.

À partir d’un contrat PDF encodé en base64, recherchez l’adresse e-mail du fournisseur et indiquez REDACTED comme remplacement ASCII.

Le résultat comprend un PDF encodé en base64, le nombre de pages traitées et le nombre d’occurrences trouvées.

Limites

  • La recherche concerne le texte de pages d’un PDF valide encodé en base64 et ne couvre pas les contenus présents uniquement dans des images ou nécessitant une reconnaissance optique des caractères.

Erreurs fréquentes

  • Une recherche vide échoue avant le traitement, tandis qu’un passage présent seulement dans une image ne peut pas être trouvé. Saisissez une chaîne non vide visible comme texte sélectionnable.

Questions fréquentes

L’outil peut-il masquer du texte dans une image intégrée à un PDF ?

Seulement si le passage est disponible comme texte sélectionnable dans la page. Un contenu présent uniquement dans une image ou nécessitant une reconnaissance optique des caractères n’est pas couvert par cette recherche.

Quel type de fichier faut-il fournir ?

Le fichier doit être un PDF valide fourni en base64, dont les octets décodés commencent par la signature d’un PDF. Une entrée absente ou invalide fait échouer le traitement.

Puis-je définir un texte de remplacement ?

Oui, avec une valeur composée de caractères ASCII pour l’annotation associée. Une valeur non ASCII n’est pas fournie comme texte d’annotation, et l’absence de valeur entraîne l’utilisation du remplacement prévu par défaut.

Outil

Caviarder un PDF