En quoi consiste cet outil ?
Cet outil supprime les caractères indésirables du texte selon deux modes au choix. « Ponctuation seule » cible les signes de ponctuation courants — points, virgules, points d'exclamation, guillemets, parenthèses et symboles similaires — sans toucher aux lettres, chiffres ou autres caractères. « Tous les caractères spéciaux » est plus large : il supprime tout ce qui n'est ni lettre, ni chiffre, ni espace, avec une correspondance compatible Unicode afin que les lettres accentuées et les alphabets non latins (chinois, cyrillique, arabe, etc.) soient correctement conservés comme des lettres et non supprimés.
Une case « Conserver les espaces » contrôle si les caractères supprimés laissent un vide (espaces conservés) ou si les mots restants sont rapprochés avec un espacement simple normalisé.
Pourquoi l'utiliser ?
- Deux modes clairs — ponctuation seule ou tous les caractères spéciaux — plutôt qu'un comportement fixe unique.
- Compatible Unicode : conserve correctement les lettres accentuées et non latines comme des lettres, pas comme des caractères spéciaux.
- Option pour conserver ou fusionner les espaces laissés par les caractères supprimés.
- Traitement local — le texte ne quitte jamais votre navigateur.
- Sans inscription, sans limite, gratuit.
Mode d'emploi
- Collez votre texte dans le champ de saisie.
- Choisissez « Supprimer la ponctuation seulement » ou « Supprimer tous les caractères spéciaux ».
- Activez ou non « Conserver les espaces » selon que vous voulez laisser des vides ou non.
- Cliquez sur Supprimer et copiez le résultat.
Exemple
Entrée
Hello, World! (test)Résultat
Hello World testLe mode ponctuation seule supprime la virgule, le point d'exclamation et les parenthèses, en laissant les mots séparés par les espaces d'origine.
Utilisations courantes
- Nettoyer du texte avant de l'envoyer à un compteur de fréquence de mots ou à un index de recherche.
- Retirer les artefacts de mise en forme d'un texte copié depuis un PDF ou un document scanné.
- Préparer du texte pour la tokenisation dans un script d'apprentissage des langues ou de NLP.
- Retirer les guillemets et la ponctuation d'une liste avant de dédupliquer les entrées.
Foire aux questions
Que couvre « ponctuation » par rapport à « tous les caractères spéciaux » ?
Ponctuation seule supprime les signes comme . , ! ? ; : ' " ( ) [ ] { } et symboles similaires servant à structurer les phrases. Tous les caractères spéciaux est plus large : cela supprime aussi des symboles comme @ # $ % ^ & * qui ne sont pas strictement de la ponctuation mais ne sont ni des lettres ni des chiffres.
Cela supprimera-t-il le chinois, l'arabe ou les lettres accentuées ?
Non. Les deux modes utilisent une correspondance de caractères compatible Unicode, donc les lettres de n'importe quel alphabet — plus les lettres latines accentuées comme é ou ü — sont correctement reconnues comme des lettres et conservées, pas traitées comme des caractères spéciaux.
Que deviennent les espaces lors de la suppression de la ponctuation ?
Si « Conserver les espaces » est coché, l'espacement d'origine entre les mots est préservé (seuls les doubles espaces accidentels sont fusionnés). Sinon, tous les espaces sont normalisés en espaces simples et supprimés en début/fin.
Cela affecte-t-il les chiffres ?
Les chiffres ne sont jamais supprimés par aucun des deux modes — seuls la ponctuation ou les symboles non alphanumériques sont retirés, les chiffres sont toujours conservés.
Mon texte est-il envoyé quelque part ?
Non. Le traitement se fait localement en JavaScript dans votre navigateur ; rien n'est envoyé à un serveur.