CodeKitHub
Szöveges eszközök

Online szövegtisztító

Utolsó frissítés:

A legtöbb online duplikátum-sor eltávolító eszköz pontosan egy dolgot tud. Ez az eszköz az öt igazán szükséges tisztítási műveletet — deduplikálás, üres sorok eltávolítása, szóközök levágása, szóközök összevonása és rendezés — egyetlen menetbe, jelölőnégyzetekkel egyesíti, így a zavaros listák és beillesztett adatok egy kattintással javíthatók, öt külön eszköz helyett.

Mi ez az eszköz?

A beillesztett listák — táblázatokból, e-mail exportokból, naplófájlokból, lekapart adatokból — rendszeresen ugyanazzal az öt problémával küzdenek: duplikált bejegyzések, üres sorok, következetlen elöl/hátul lévő szóközök, dupla szóközök ott, ahol egynek kellene lennie, és semmiféle rendezettség. Mind az öt javítása általában külön, egycélú eszközök közötti ugrálást jelent.

Ez az eszköz mind az öt műveletet egyetlen lépésben futtatja jelölőnégyzetekkel, olyan sorrendben, amely valóban számít (a szóközök levágása és összevonása a deduplikálás előtt történik, hogy a „foo ” és a „foo” helyesen azonos sorként legyen felismerve).

Miért érdemes használni?

  • Öt valódi tisztítási művelet egyetlen menetben, nem csak deduplikálás.
  • Jelölőnégyzetes vezérlés — kapcsolj ki bármely lépést, amelyre nincs szükséged.
  • A műveletek olyan sorrendben futnak, amely helyes eredményt ad (a szóközök normalizálása a deduplikálás előtt).
  • Pontosan mutatja, hány sor lett eltávolítva.
  • Helyi és privát — a szöveg soha nem hagyja el a böngésződet.

Használati útmutató

  1. Illeszd be a szövegedet vagy listádat a beviteli mezőbe.
  2. Jelöld be a kívánt műveleteket (a rendezés kivételével mind be van kapcsolva alapértelmezetten).
  3. Kattints a Tisztítás gombra — az eredmény alul jelenik meg, az eltávolított sorok számával.
  4. Másold ki a megtisztított eredményt.

Példa

Bemenet

alma 
banán

alma
  banán  
cseresznye

Kimenet

alma
banán
cseresznye

A szóközök normalizálása előbb történik, így az „alma ” és az „alma” duplikátumként felismerésre és összevonásra kerül — ezt sok egyszerűbb eszköz elrontja.

Gyakori felhasználások

  • Egy táblázatból exportált lista deduplikálása, mielőtt visszaimportálnád.
  • Több forrásból összefésült e-mail lista tisztítása, ismételt címek eltávolítása.
  • Naplófájl-kimenet rendezése — üres sorok és duplikált bejegyzések eltávolítása elemzés előtt.
  • Kulcsszó- vagy URL-lista előkészítése SEO-eszközökhöz, soronként egy tiszta bejegyzéssel.

Miért befolyásolja a művelet sorrendje az eredményt

Ha ezt az öt műveletet rossz sorrendben futtatod, finoman hibás eredményeket kapsz, ezért ez az eszköz rögzíti a sorrendet ahelyett, hogy a lépéseket bármilyen kombinációban engedné futni. A legvilágosabb példa: ha a deduplikálás a szóközök levágása előtt futna, az „alma” és az „alma ” (záró szóközzel) két különböző sorként lenne kezelve, és mindkettő megmaradna, csendben meghiúsítva a deduplikálás egész célját. Ha előbb fut a levágás és az összevonás, minden sor a végleges, kanonikus formájában van, mielőtt az eszköz ellenőrizné a duplikátumokat, így az érdemben azonos sorok — a másolás-beillesztésből származó elszórt szóközöktől függetlenül — helyesen felismerésre kerülnek. Ugyanez a logika érvényes az üres sorok eltávolítására is, ami a deduplikálás előtt történik: a különböző forrásokból felgyülemlett üres sorok különben olyan módokon lennének összehasonlítva egymással, amelyek nem számítanak a tényleges tartalom szempontjából.

Gyakori kérdések

Milyen sorrendben alkalmazódnak a műveletek?

Levágás → szóközök összevonása → üres sorok eltávolítása → deduplikálás → rendezés. Ez a sorrend számít: a szóközök normalizálása a deduplikálás előtt biztosítja, hogy a csak elszórt szóközökben eltérő sorok helyesen duplikátumként legyenek kezelve.

A deduplikálás megkülönbözteti a kis- és nagybetűket?

Igen — az „Alma” és az „alma” eltérő sorként kezelt. Ez elkerüli, hogy valóban különböző bejegyzések véletlenül összevonódjanak; ha nem kis-/nagybetű-érzékeny egyezésre van szükséged, alakítsd előbb kisbetűssé a szöveget.

Mi alapján rendez a kínai szöveg esetén?

Pinjin-alapú betűrend szerint, így a kínai bejegyzések úgy rendeződnek, ahogy egy telefon névjegyzékében tennék, nem a nyers karakterkód alapján.

Kezel egy nagyon nagy listát is?

Igen — a feldolgozás a böngésződben történik, méretkorlát nélkül, csak az eszközöd memóriája szab határt, ami messze meghaladja a tipikus táblázat-export méreteket.

Feltöltésre kerül valahova az adatom?

Nem. Mind az öt művelet helyi JavaScriptként fut a böngésződben. Semmi nem kerül szerverre, így biztonságosan használható exportált ügyféllistákon vagy más érzékeny adatokon.

Ez ugyanaz, mint egy „duplikált sor eltávolító”?

Igen — a duplikált sorok eltávolítása az itt elérhető öt művelet egyike (a levágás, szóköz-összevonás, üres sorok eltávolítása és rendezés mellett). Csak a „Duplikátumok eltávolítása” jelölőnégyzetet pipáld ki, ha csak arra van szükséged; a másik négy opcionális.

Kapcsolódó eszközök