Що це за інструмент?
Цей інструмент видаляє небажані символи з тексту у двох режимах на вибір. "Лише розділові знаки" націлений на поширені розділові знаки — крапки, коми, знаки оклику, лапки, дужки та подібні символи — залишаючи літери, цифри та інші символи недоторканими. "Усі спеціальні символи" — ширший варіант: він видаляє все, що не є літерою, цифрою чи пробілом, використовуючи зіставлення з урахуванням Unicode, тому літери з діакритичними знаками та нелатинські писемності (китайська, кирилиця, арабська тощо) правильно зберігаються як літери, а не видаляються.
Прапорець "зберегти пробіли" визначає, чи залишають видалені символи проміжок (пробіли збережено), чи решта слів об’єднуються з нормалізованим одинарним пробілом.
Навіщо його використовувати?
- Два чіткі режими — лише розділові знаки або всі спеціальні символи — замість однієї фіксованої поведінки.
- З урахуванням Unicode: правильно зберігає літери з діакритичними знаками та нелатинські літери як літери, а не спеціальні символи.
- Можливість зберегти або об’єднати пробіли, що залишилися після видалених символів.
- Локальна обробка — текст ніколи не залишає ваш браузер.
- Без реєстрації, без обмежень, безкоштовне використання.
Як користуватися
- Вставте свій текст у поле введення.
- Виберіть "Видалити лише розділові знаки" або "Видалити всі спеціальні символи".
- Увімкніть/вимкніть "Зберегти пробіли" залежно від того, чи хочете ви залишити проміжки.
- Натисніть Видалити та скопіюйте результат.
Приклад
Введення
Hello, World! (test)Результат
Hello World testРежим лише розділових знаків видаляє кому, знак оклику та дужки, залишаючи слова розділеними початковими пробілами.
Поширені застосування
- Очищення тексту перед подачею його в лічильник частоти слів або пошуковий індекс.
- Видалення артефактів форматування з тексту, скопійованого з PDF або відсканованого документа.
- Підготовка тексту для токенізації у скрипті вивчення мови або NLP.
- Видалення лапок і розділових знаків зі списку перед дедублікацією записів.
Часті запитання
Що вважається "розділовим знаком" на відміну від "усіх спеціальних символів"?
Лише розділові знаки видаляє знаки на кшталт . , ! ? ; : ' " ( ) [ ] { } та подібні символи, що використовуються для структурування речень. Усі спеціальні символи — ширший варіант, він також видаляє символи на кшталт @ # $ % ^ & *, які не є суворо розділовими знаками, але й не є літерами чи цифрами.
Чи видалить це китайські, арабські чи літери з діакритичними знаками?
Ні. Обидва режими використовують зіставлення символів з урахуванням Unicode, тому літери з будь-якої писемності — а також латинські літери з діакритичними знаками, як é чи ü — правильно розпізнаються як літери та зберігаються, а не розглядаються як спеціальні символи.
Що відбувається з пробілами при видаленні розділових знаків?
Якщо позначено "Зберегти пробіли", початкові відступи між словами зберігаються (об’єднуються лише випадкові подвійні пробіли). Якщо не позначено, усі пробіли нормалізуються до одинарних і обрізаються.
Чи працює це з числами?
Числа ніколи не видаляються жодним із режимів — видаляються лише розділові знаки чи неалфавітно-цифрові символи, цифри завжди зберігаються.
Чи завантажується мій текст кудись?
Ні. Обробка відбувається локально на JavaScript у вашому браузері; нічого не надсилається на сервер.