Como limpar e normalizar um texto
Cole o texto, selecione as operações de limpeza reconhecidas pela ordem pretendida e execute o processamento. O resultado contém o texto transformado; texto vazio ou ausente devolve um resultado vazio sem aplicar operações.
Para que serve
O Text Cleaner serve para preparar texto fornecido por si antes de o reutilizar, por exemplo quando precisa de uniformizar espaços, caracteres ou certos elementos misturados no conteúdo. Pode escolher operações de limpeza para tratar o texto de forma sequencial, respeitando a ordem em que as indicar.
O texto é opcional: se ficar vazio ou não for fornecido, o resultado fica vazio e nenhuma operação é aplicada. As opções reconhecidas podem tratar espaços e caracteres, remover determinados padrões, como algumas etiquetas semelhantes a HTML, endereços HTTP ou HTTPS, endereços de email, algarismos e sinais de pontuação, além de eliminar palavras repetidas consecutivamente.
Como limpar o texto
-
Cole o conteúdo a limpar no campo de texto. Se não fornecer texto, a ferramenta termina com um resultado vazio.
-
Na área de opções, selecione as operações pretendidas e mantenha-as pela ordem em que devem ser aplicadas. As opções são apresentadas como texto, mas o processamento espera uma coleção iterável e ordenada de nomes de operações. Uma opção vazia significa que não foi escolhida nenhuma operação; um valor preenchido incompatível pode causar uma falha.
-
Escolha operações de espaços se quiser retirar espaços no início e no fim de cada linha, reduzir sequências de espaços ou tabulações, remover linhas compostas apenas por espaços e uniformizar determinados espaços Unicode.
-
Escolha operações de normalização de caracteres se precisar de converter aspas curvas em aspas direitas, transformar certos travessões em hífen, substituir o carácter de reticências por três pontos, uniformizar mudanças de linha ou remover caracteres de controlo especificados.
-
Selecione, quando necessário, operações para remover padrões específicos: etiquetas semelhantes a HTML, endereços HTTP ou HTTPS, endereços de email que correspondam ao padrão usado, algarismos ou determinados sinais de pontuação. Também pode escolher a limpeza de uma palavra imediatamente repetida, desde que esteja separada por espaços; essa comparação não distingue maiúsculas de minúsculas.
-
Execute o processamento e leia o texto devolvido. Se tiver escolhido várias operações, confirme o efeito da sequência: uma transformação anterior pode alterar o conteúdo que a seguinte recebe. Opções com nomes não reconhecidos são ignoradas, não aplicadas.
Como interpretar o resultado
O resultado é um texto transformado apenas pelas operações reconhecidas e selecionadas. Por isso, a ausência de uma alteração pode significar que a opção não foi escolhida, que o conteúdo não correspondia ao padrão específico ou que o nome da opção não foi reconhecido.
Leia o resultado tendo em conta a ordem aplicada. Por exemplo, normalizar espaços antes de procurar uma repetição pode influenciar a forma como duas palavras consecutivas são identificadas. Do mesmo modo, remover pontuação, algarismos ou padrões de endereços pode alterar o conteúdo de forma que não é reversível no próprio resultado.
A ferramenta não deve ser tratada como um filtro de segurança ou como uma limpeza abrangente. As remoções dependem dos padrões e conjuntos de caracteres suportados; o facto de um endereço, etiqueta, sinal ou palavra parecer semelhante não garante que seja removido.
Exemplo prático
Tem uma nota com espaços extra no início das linhas e uma palavra repetida consecutivamente e quer uniformizar esses elementos antes de reutilizar o texto.
Cole o conteúdo, selecione primeiro a operação de normalização de espaços e depois a operação de eliminação de palavras repetidas, e execute o processamento.
O resultado é um campo de texto com o conteúdo processado, no qual as transformações reconhecidas aparecem pela ordem selecionada; não é garantida a remoção de padrões que não correspondam aos critérios suportados.
Limitações
- A remoção abrange apenas os padrões e conjuntos de caracteres suportados; não é garantida para todas as variações de etiquetas, endereços, sinais ou palavras.
Erros comuns
- Causa: introduzir um valor preenchido que não corresponde a uma coleção iterável de nomes de operações. Correção: use uma coleção ordenada de escolhas reconhecíveis ou deixe as opções vazias quando não quiser aplicar transformações.
Perguntas frequentes
Posso usar a ferramenta sem introduzir texto?
Sim, mas o comportamento depende do valor fornecido: texto vazio ou ausente termina corretamente com resultado vazio, enquanto um valor preenchido incompatível com a coleção esperada pode causar uma falha.
A ferramenta remove todos os endereços, sinais e etiquetas do texto?
Não necessariamente. Só são aplicadas as escolhas reconhecidas; nomes não reconhecidos são ignorados e os padrões removidos dependem dos critérios suportados pela ferramenta.
A ordem das operações de limpeza altera o resultado?
Sim, a ordem conta: as escolhas reconhecidas são aplicadas sequencialmente pela ordem fornecida. Uma alteração inicial pode mudar o conteúdo analisado pela operação seguinte.