CodeKitHub
Tekstværktøjer

Fjern tegnsætning og specialtegn

Senest opdateret:

Indsæt tekst, vælg kun tegnsætning eller alle specialtegn, og dette værktøj fjerner dem med ét klik — og bevarer bogstaver, tal og (valgfrit) mellemrum intakte. Kører helt i din browser.

Hvad er dette værktøj?

Dette værktøj fjerner uønskede tegn fra tekst i to valgbare tilstande. "Kun tegnsætning" er rettet mod almindelige tegnsætningstegn — punktummer, kommaer, udråbstegn, anførselstegn, parenteser og lignende symboler — mens bogstaver, tal og andre tegn forbliver urørte. "Alle specialtegn" er bredere: det fjerner alt, der ikke er et bogstav, et tal eller et mellemrum, ved hjælp af Unicode-bevidst matchning, så bogstaver med accenter og ikke-latinske skriftsystemer (kinesisk, kyrillisk, arabisk osv.) korrekt bevares som bogstaver i stedet for at blive fjernet.

Et afkrydsningsfelt "bevar mellemrum" styrer, om fjernede tegn efterlader et hul (mellemrum bevares), eller om de resterende ord samles med normaliseret enkelt mellemrum.

Hvorfor bruge det?

  • To klare tilstande — kun tegnsætning eller alle specialtegn — i stedet for én fast adfærd.
  • Unicode-bevidst: bevarer korrekt bogstaver med accenter og ikke-latinske bogstaver som bogstaver, ikke specialtegn.
  • Mulighed for at bevare eller sammenlægge mellemrum, der er tilbage efter fjernede tegn.
  • Lokal behandling — tekst forlader aldrig din browser.
  • Ingen tilmelding, ingen grænser, gratis at bruge.

Sådan bruger du det

  1. Indsæt din tekst i inputfeltet.
  2. Vælg "Fjern kun tegnsætning" eller "Fjern alle specialtegn".
  3. Slå "Bevar mellemrum" til eller fra afhængigt af, om du vil efterlade huller.
  4. Klik på Fjern, og kopiér resultatet.

Eksempel

Input

Hello, World! (test)

Output

Hello World test

Kun tegnsætning-tilstanden fjerner kommaet, udråbstegnet og parenteserne, og efterlader ordene adskilt af de oprindelige mellemrum.

Almindelige anvendelser

  • Rensning af tekst, før den føres ind i en ordfrekvenstæller eller søgeindeks.
  • Fjernelse af formateringsartefakter fra tekst kopieret fra en PDF eller et scannet dokument.
  • Forberedelse af tekst til tokenisering i et sprogindlærings- eller NLP-script.
  • Fjernelse af anførselstegn og tegnsætning fra en liste, før poster dedupliceres.

Ofte stillede spørgsmål

Hvad tæller som "tegnsætning" versus "alle specialtegn"?

Kun tegnsætning fjerner tegn som . , ! ? ; : ' " ( ) [ ] { } og lignende symboler, der bruges til at strukturere sætninger. Alle specialtegn er en bredere mulighed — det fjerner også symboler som @ # $ % ^ & *, som ikke strengt taget er tegnsætning, men heller ikke er bogstaver eller tal.

Vil dette fjerne kinesiske, arabiske eller accentuerede bogstaver?

Nej. Begge tilstande bruger Unicode-bevidst tegnmatchning, så bogstaver fra ethvert skriftsystem — plus latinske bogstaver med accenter som é eller ü — genkendes korrekt som bogstaver og bevares, i stedet for at blive behandlet som specialtegn.

Hvad sker der med mellemrum, når jeg fjerner tegnsætning?

Hvis "Bevar mellemrum" er markeret, bevares den oprindelige afstand mellem ord (kun utilsigtede dobbelte mellemrum sammenlægges). Hvis ikke markeret, normaliseres alle mellemrum til enkelt mellemrum og trimmes.

Virker dette på tal?

Tal fjernes aldrig af nogen af tilstandene — kun tegnsætning eller ikke-alfanumeriske symboler fjernes, cifre bevares altid.

Bliver min tekst uploadet nogen steder?

Nej. Behandlingen sker lokalt i JavaScript i din browser; intet sendes til en server.

Relaterede værktøjer