CodeKitHub
Besedilna orodja

Čistilnik besedila na spletu

Nazadnje posodobljeno:

Večina spletnih orodij za podvojene vrstice naredi natanko eno stvar. To orodje združi pet postopkov čiščenja, ki jih dejansko potrebuješ — odstranjevanje podvojenih vrstic, praznih vrstic, obrezovanje presledkov, strnjevanje presledkov in razvrščanje — v en sam korak s potrditvenimi polji, tako da so neurejeni seznami in prilepljeni podatki popravljeni z enim klikom namesto s petimi ločenimi orodji.

Kaj je to orodje?

Prilepljeni seznami — iz preglednic, izvozov e-pošte, dnevniških datotek, izluščenih podatkov — redno prinašajo istih pet težav: podvojene vnose, prazne vrstice, neenotne presledke na začetku/koncu, dvojne presledke, kjer bi moral biti eden, in nikakršen določen vrstni red. Odpravljanje vseh petih običajno pomeni preklapljanje med ločenimi orodji z enim samim namenom.

To orodje izvede vseh pet kot en sam postopek s potrditvenimi polji, v vrstnem redu, ki dejansko šteje (obreži in strni presledke pred odstranjevanjem podvojenih vrstic, tako da sta "jabolko " in "jabolko" pravilno prepoznana kot ista vrstica).

Zakaj ga uporabiti?

  • Pet resničnih postopkov čiščenja v enem koraku, ne le odstranjevanje podvojenih vrstic.
  • Nadzor s potrditvenimi polji — izklopi katerikoli korak, ki ga ne želiš.
  • Postopki se izvajajo v vrstnem redu, ki daje pravilne rezultate (presledki normalizirani pred odstranjevanjem duplikatov).
  • Prikaže natanko, koliko vrstic je bilo odstranjenih.
  • Lokalno in zasebno — besedilo nikoli ne zapusti tvojega brskalnika.

Kako ga uporabljati

  1. Prilepi svoje besedilo ali seznam v vnosno polje.
  2. Označi postopke, ki jih želiš (vsi razen razvrščanja so privzeto vklopljeni).
  3. Klikni Počisti — rezultat se prikaže spodaj s številom odstranjenih vrstic.
  4. Kopiraj počiščen rezultat.

Primer

Vnos

jabolko 
banana

jabolko
  banana  
češnja

Rezultat

jabolko
banana
češnja

Presledki se najprej normalizirajo, tako da sta "jabolko " in "jabolko" prepoznana kot dvojnika in združena — pogosta napaka pri preprostejših orodjih.

Pogoste uporabe

  • Odstranjevanje podvojenih vnosov iz seznama, izvoženega iz preglednice ali CRM sistema, pred ponovnim uvozom.
  • Čiščenje seznama e-poštnih naslovov, združenega iz več virov, z odstranjevanjem ponovljenih naslovov.
  • Urejanje izpisa dnevniških datotek — odstranjevanje praznih vrstic in podvojenih vnosov pred analizo.
  • Priprava seznama ključnih besed ali URL-jev za SEO orodja, en čist vnos na vrstico.

Zakaj vrstni red postopkov spremeni rezultat

Izvajanje teh petih postopkov v napačnem vrstnem redu daje rahlo napačne rezultate, zato to orodje določi zaporedje namesto da bi koraki potekali v poljubni kombinaciji. Najjasnejši primer: če bi odstranjevanje duplikatov teklo pred obrezovanjem presledkov, bi bili "jabolko" in "jabolko " (s presledkom na koncu) obravnavani kot dve različni vrstici in obe ohranjeni, kar bi tiho izničilo celoten namen odstranjevanja duplikatov. Izvajanje obrezovanja in strnjevanja najprej pomeni, da je vsaka vrstica v svoji končni, kanonični obliki, preden orodje preveri duplikate, tako da so vrstice, ki so vsebinsko enake — ne glede na odvečne presledke, pridobljene s kopiranjem in lepljenjem — pravilno prepoznane kot take. Enaka logika velja za odstranjevanje praznih vrstic pred odstranjevanjem duplikatov: kopičenje praznih vrstic iz različnih virov bi se sicer med seboj primerjalo na načine, ki za dejansko vsebino niso pomembni.

Pogosta vprašanja

V kakšnem vrstnem redu se postopki izvajajo?

Obreži → strni presledke → odstrani prazne vrstice → odstrani duplikate → razvrsti. Ta vrstni red je pomemben: normaliziranje presledkov pred odstranjevanjem duplikatov pomeni, da so vrstice, ki se razlikujejo le po odvečnih presledkih, pravilno obravnavane kot duplikati.

Ali odstranjevanje duplikatov razlikuje med velikimi in malimi črkami?

Da — "Jabolko" in "jabolko" se obravnavata kot različni vrstici. To preprečuje nenamerno združevanje resnično različnih vnosov; če potrebuješ ujemanje ne glede na velikost črk, besedilo najprej pretvori v male črke.

Kaj razvrščanje uporablja za kitajsko besedilo?

Abecedni vrstni red na podlagi pinyina, tako da se kitajski vnosi razvrstijo tako, kot bi se v telefonskem imeniku, ne po surovi kodi znaka.

Ali bo to obdelalo zelo dolg seznam?

Da — obdelava poteka v tvojem brskalniku brez omejitve velikosti razen tega, kar zmore spomin tvoje naprave, kar je precej več od tipičnih izvozov preglednic.

Ali se moji podatki kam naložijo?

Ne. Vseh pet postopkov se izvaja kot lokalni JavaScript v tvojem brskalniku. Nič se ne pošilja na strežnik, zato je to varno za uporabo na izvoženih seznamih strank ali drugih občutljivih podatkih.

Ali je to isto kot "odstranjevalec podvojenih vrstic"?

Da — odstranjevanje podvojenih vrstic je eden od petih postopkov tukaj (skupaj z obrezovanjem, strnjevanjem presledkov, odstranjevanjem praznih vrstic in razvrščanjem). Če potrebuješ samo to, označi le "Odstrani duplikate"; ostali štirje koraki so izbirni.

Sorodna orodja