CodeKitHub
Français
Outils de texte

Nettoyeur de texte en ligne

La plupart des outils en ligne destinés à traiter les lignes en double ne font qu'une seule chose. Celui-ci regroupe les cinq opérations de nettoyage dont vous avez réellement besoin — déduplication, suppression des lignes vides, suppression des espaces superflus, regroupement des espaces et tri — en un seul passage à l'aide de cases à cocher. Ainsi, les listes désordonnées et les données collées sont corrigées en un seul clic, au lieu d'avoir à utiliser cinq outils distincts.

En quoi consiste cet outil ?

Les listes collées — issues de feuilles de calcul, d'exportations d'e-mails, de fichiers journaux ou de données extraites — présentent systématiquement les cinq problèmes suivants : entrées en double, lignes vides, espaces de début et de fin incohérents, doubles espaces là où il n'y en aurait qu'un, et absence d'ordre particulier. Pour corriger ces cinq problèmes, il faut généralement passer d'un outil à l'autre, chacun étant dédié à une seule tâche.

Cet outil exécute ces cinq opérations en une seule, à l'aide de cases à cocher, dans l'ordre qui importe réellement (suppression et regroupement des espaces avant la déduplication, afin que « foo » et « foo » soient correctement reconnus comme appartenant à la même ligne).

Pourquoi l'utiliser ?

  • Cinq opérations de nettoyage réelles en un seul passage, et pas seulement une déduplication.
  • Case à cocher : décochez les étapes que vous ne souhaitez pas effectuer.
  • Les opérations sont exécutées dans l'ordre qui permet d'obtenir des résultats corrects (normalisation des espaces avant la déduplication).
  • Indique précisément le nombre de lignes qui ont été supprimées.
  • Local et privé : le texte ne quitte jamais votre navigateur.

Mode d'emploi

  1. Collez votre texte ou votre liste dans le champ de saisie.
  2. Cochez les opérations souhaitées (toutes sont activées par défaut, à l'exception du tri).
  3. Cliquez sur « Nettoyer » — le résultat s'affiche ci-dessous avec le nombre de lignes supprimées.
  4. Copiez le résultat nettoyé.

Exemple

Entrée

apple 
banana

apple
  banana  
cherry

Résultat

apple
banana
cherry

Les espaces sont d'abord normalisés ; ainsi, « apple » et « apple » sont identifiés comme des doublons et fusionnés — une erreur courante dans les outils plus simples.

Utilisations courantes

  • Dédupliquer une liste exportée depuis un tableur ou un CRM avant de la réimporter.
  • Nettoyage d'une liste de diffusion issue de la fusion de plusieurs sources, en supprimant les adresses en double.
  • Nettoyage du contenu du fichier journal — suppression des lignes vides et des entrées en double avant l'analyse.
  • Préparer une liste de mots-clés ou d'URL pour les outils de référencement, avec une entrée par ligne.

Pourquoi l'ordre des opérations modifie le résultat

L'exécution de ces cinq opérations dans le mauvais ordre produit des résultats légèrement erronés ; c'est pourquoi cet outil définit un ordre fixe plutôt que de laisser les étapes s'exécuter dans n'importe quelle combinaison. L'exemple le plus parlant : si la déduplication était effectuée avant le suppression des espaces, « apple » et « apple » (avec un espace final) seraient traités comme deux lignes distinctes et tous deux conservés, ce qui irait à l'encontre de l'objectif même de la déduplication. En exécutant d’abord le nettoyage et la fusion, chaque ligne se présente sous sa forme finale et canonique avant que l’outil ne recherche les doublons ; ainsi, les lignes qui sont intrinsèquement identiques — indépendamment des espaces superflus introduits par un copier-coller — sont correctement reconnues comme telles. La même logique s’applique à la suppression des lignes vides effectuée avant la déduplication : sans cela, une accumulation de lignes vides provenant de différentes sources serait comparée entre elles d’une manière qui n’a aucune incidence sur le contenu réel.

Foire aux questions

Dans quel ordre les opérations sont-elles appliquées ?

Nettoyer → regrouper les espaces → supprimer les lignes vides → supprimer les doublons → trier. L'ordre est important : normaliser les espaces avant de supprimer les doublons permet de traiter correctement comme des doublons les lignes qui ne diffèrent que par des espaces superflus.

La déduplication tient-elle compte de la casse ?

Oui — « Apple » et « apple » sont considérés comme des lignes distinctes. Cela permet d'éviter de fusionner par inadvertance des entrées réellement différentes ; si vous avez besoin d'une correspondance sans distinction de majuscules/minuscules, mettez d'abord votre texte en minuscules.

Quel est le principe de tri utilisé pour le texte chinois ?

Classement alphabétique basé sur le pinyin : les entrées en chinois sont ainsi classées comme elles le seraient dans un répertoire téléphonique, et non en fonction de leur code de caractère brut.

Est-ce que cela permettra de gérer une très longue liste ?

Oui — le traitement s'effectue dans votre navigateur, sans aucune limite de taille au-delà de la capacité de mémoire de votre appareil, ce qui dépasse largement les tailles habituelles des fichiers exportés depuis un tableur.

Mes données sont-elles stockées quelque part ?

Non. Ces cinq opérations s'exécutent sous forme de code JavaScript local dans votre navigateur. Aucune donnée n'est envoyée à un serveur ; vous pouvez donc les utiliser en toute sécurité sur des listes de clients exportées ou d'autres données sensibles.

Est-ce que cela revient à un « outil de suppression des lignes en double » ?

Oui — la suppression des lignes en double fait partie des cinq opérations proposées ici (avec le rognage, la compression des espaces, la suppression des espaces vides et le tri). Cochez uniquement la case « Supprimer les doublons » si c'est tout ce dont vous avez besoin ; les quatre autres opérations sont facultatives.

Outils associés