Для текста из PDF и Word
После копирования из PDF часто появляются странные переносы, лишние пробелы и пустые строки. Этот инструмент быстро приводит текст в нормальный вид.
Вставь грязный текст из PDF, Word, сайта, Telegram или таблицы. Инструмент уберёт лишние пробелы, переносы, пустые строки, HTML-теги, emoji, табы и другой цифровой мусор, который человечество почему-то считает нормой.
После копирования из PDF часто появляются странные переносы, лишние пробелы и пустые строки. Этот инструмент быстро приводит текст в нормальный вид.
Можно удалить HTML-теги и декодировать entities вроде , & и ".
Текст очищается прямо в браузере и не отправляется на сервер. Сервер не читает твой текст, хотя некоторые сайты так и мечтают.
Текст почти никогда не приходит чистым. При копировании из Word, PDF, почты или с сайта вместе с буквами переезжают невидимые символы — их не видно на экране, но они ломают вёрстку, поиск по документу и загрузку в базу.
| Что попадает | Откуда | Чем мешает |
|---|---|---|
| Неразрывный пробел | Word, вёрстка сайтов | выглядит как пробел, но поиск и сравнение строк его не находят |
| Мягкий перенос | PDF, свёрстанные документы | слово при копировании разваливается на части |
| Символы нулевой ширины | копирование с сайтов | невидимы полностью, ломают поиск и валидацию форм |
| Типографские кавычки и тире | автозамена в редакторах | ломают код, CSV и импорт данных |
| Двойные пробелы | ручной набор | заметны в вёрстке, портят вид текста |
| Разрывы строк внутри абзаца | PDF, письма | абзац рассыпается на короткие строки |
Он выглядит точно как обычный пробел, но это другой символ. Отсюда классические загадки: поиск по документу не находит фразу, которая явно есть на экране; две одинаковые на вид строки не совпадают при сравнении; артикул не находится в каталоге. Причина одна — внутри стоит неразрывный пробел вместо обычного.
Ещё хуже с символами нулевой ширины: их не видно вообще никак. Строка выглядит нормальной, но не проходит проверку формата и не совпадает с эталоном.
Не всё лишнее — мусор. Неразрывный пробел ставят осознанно между числом и единицей измерения («10 кг»), между инициалами и фамилией, перед тире — чтобы строка не разорвалась в неудачном месте. Типографские кавычки-ёлочки в русском тексте правильнее прямых. Поэтому в готовых текстах для публикации чистку стоит делать выборочно, а не всё сразу.
Текст обрабатывается в браузере: он не отправляется на сервер и нигде не сохраняется. Это важно, потому что чистят обычно рабочие документы, договоры и переписку.
Вставь текст, оставь включённой опцию “Убрать лишние пробелы” и нажми “Очистить текст”.
Да. Включи опцию “Удалить HTML-теги”, и инструмент оставит обычный текст без разметки.
Да. Есть отдельная опция “Убрать все переносы строк”, чтобы превратить текст в одну строку.
Нет. Все операции выполняются локально в браузере.
Чаще всего это неразрывные пробелы из Word, мягкие переносы из PDF и символы нулевой ширины при копировании с сайтов. На экране их не видно, но они ломают поиск по документу, сравнение строк и загрузку данных.
Обычно из-за неразрывного пробела: выглядит он как обычный, но это другой символ, и поиск по обычному пробелу его не находит. Очистка приводит все пробелы к одному виду.
Нет. Их ставят осознанно между числом и единицей измерения или перед тире, чтобы строка не разорвалась в неудачном месте. В готовых текстах для публикации чистку лучше делать выборочно.