CodeKitHub
Tekstitööriistad

Kirjavahemärkide ja erimärkide eemaldaja

Viimati uuendatud:

Kleebi tekst, vali ainult kirjavahemärgid või kõik erimärgid, ja see tööriist eemaldab need ühe klõpsuga — jättes tähed, numbrid ja (valikuliselt) tühikud puutumata. Töötab täielikult sinu brauseris.

Mis see tööriist on?

See tööriist eemaldab tekstist soovimatud märgid kahes valitavas režiimis. "Ainult kirjavahemärgid" keskendub levinud kirjavahemärkidele — punktid, komad, hüüumärgid, jutumärgid, sulud ja sarnased sümbolid — jättes tähed, numbrid ja muud märgid puutumata. "Kõik erimärgid" on laiem: see eemaldab kõik, mis pole täht, number ega tühik, kasutades Unicode-teadlikku sobitamist, nii et rõhumärkidega tähed ja mitte-ladina kirjasüsteemid (hiina, kirillitsa, araabia jne) säilivad õigesti tähtedena, mitte ei eemaldata.

Märkeruut "säilita tühikud" määrab, kas eemaldatud märgid jätavad tühimiku (tühikud säilivad) või ühendatakse ülejäänud sõnad normaliseeritud ühekordse tühikuga.

Miks seda kasutada?

  • Kaks selget režiimi — ainult kirjavahemärgid või kõik erimärgid — mitte üks kindel käitumine.
  • Unicode-teadlik: säilitab õigesti rõhumärkidega ja mitte-ladina tähed tähtedena, mitte erimärkidena.
  • Võimalus säilitada või liita tühikud, mis jäävad eemaldatud märkide järele.
  • Kohalik töötlus — tekst ei lahku kunagi sinu brauserist.
  • Registreerimiseta, piiranguteta, tasuta kasutamiseks.

Kuidas kasutada

  1. Kleebi oma tekst sisestusväljale.
  2. Vali "Eemalda ainult kirjavahemärgid" või "Eemalda kõik erimärgid".
  3. Lülita "Säilita tühikud" sisse või välja, olenevalt sellest, kas soovid jätta tühimikke.
  4. Klõpsa Eemalda ja kopeeri tulemus.

Näide

Sisend

Hello, World! (test)

Tulemus

Hello World test

Ainult kirjavahemärkide režiim eemaldab koma, hüüumärgi ja sulud, jättes sõnad eraldatuks algsete tühikutega.

Levinud kasutusalad

  • Teksti puhastamine enne selle sisestamist sõnasageduse loenduri või otsinguindeksisse.
  • Vormindusartefaktide eemaldamine PDF-ist või skaneeritud dokumendist kopeeritud tekstist.
  • Teksti ettevalmistamine tokeniseerimiseks keeleõppe- või NLP-skriptis.
  • Jutumärkide ja kirjavahemärkide eemaldamine loendist enne kirjete dubleerimise kõrvaldamist.

Korduma kippuvad küsimused

Mis loetakse "kirjavahemärgiks" versus "kõikideks erimärkideks"?

Ainult kirjavahemärgid eemaldab märgid nagu . , ! ? ; : ' " ( ) [ ] { } ja sarnased sümbolid, mida kasutatakse lausete struktureerimiseks. Kõik erimärgid on laiem valik — see eemaldab ka sümboleid nagu @ # $ % ^ & *, mis ei ole rangelt kirjavahemärgid, kuid pole ka tähed ega numbrid.

Kas see eemaldab hiina, araabia või rõhumärkidega tähed?

Ei. Mõlemad režiimid kasutavad Unicode-teadlikku märkide sobitamist, nii et tähed mis tahes kirjasüsteemist — pluss ladina tähed rõhumärkidega nagu é või ü — tuvastatakse õigesti tähtedena ja säilitatakse, mitte ei käsitleta erimärkidena.

Mis juhtub tühikutega, kui eemaldan kirjavahemärgid?

Kui "Säilita tühikud" on märgitud, säilib sõnade vaheline algne tühik (liidetakse ainult juhuslikud topelttühikud). Kui pole märgitud, normaliseeritakse kõik tühikud üheks tühikuks ja kärbitakse.

Kas see töötab numbritega?

Numbreid ei eemaldata kummagi režiimi poolt kunagi — eemaldatakse ainult kirjavahemärgid või mitte-tähtnumbrilised sümbolid, numbrid säilivad alati.

Kas mu tekst laaditakse kuhugi üles?

Ei. Töötlus toimub kohalikult JavaScriptis sinu brauseris; midagi ei saadeta serverisse.

Seotud tööriistad