Массовая очистка формата текста Удалите смешение полной/половинной ширины, невидимые символы и следы копирования из ИИ одним нажатием
Шаг 1: вставьте текст для очистки
Шаг 2: результаты обнаружения
Эти цифры получены путём точного посимвольного сканирования, а не смысловой оценки — именно с этим у ИИ-чатов плохо: они отлично понимают смысл текста, но, как известно, ненадёжны при точном подсчёте символов.
Шаг 3: выберите, что очищать
Обнаруживает буквы/цифры/символы полной ширины, смешанные с текстом половинной ширины (или наоборот), и позволяет выбрать направление нормализации.
Удаляет пробелы нулевой ширины, соединители, BOM и другие символы, невидимые глазу, но нарушающие поиск и вёрстку.
Исправляет следы форматирования, которые часто остаются при копировании из ИИ-чатов.
Сжимает повторяющиеся пробелы и пустые строки, убирает лишние пробелы в начале/конце каждой строки.
Почему вставленный текст иногда выглядит «сломанным»?
При копировании текста из ChatGPT, Word, PDF или переведённых документов он часто содержит символы, невидимые глазу, но реально обрабатываемые компьютером — пробелы нулевой ширины, остатки метки порядка байтов (BOM) или символы управления направлением текста. Эти невидимые символы могут ломать поиск, портить подсчёт символов и даже вызывать ложные срабатывания «дублированного контента» при вставке в CMS, таблицу или код. Кроме того, ИИ-чаты часто оставляют стилистические следы: «умные» кавычки (“” ‘’), унифицированные длинные тире (—) и символы разметки Markdown (**жирный**, # заголовок), предназначенные для отображения в чате, а не в вашем документе.
Этот инструмент работает на 100% локально в вашем браузере. Всё, что вы вставляете, никогда не отправляется на сервер.
Что этот инструмент обнаруживает и очищает
- Нормализация полной/половинной ширины: обнаруживает буквы, цифры и символы полной ширины, смешанные с текстом половинной ширины (или наоборот), и позволяет привести всё к единой ширине.
- Невидимые символы Unicode: находит и удаляет пробел нулевой ширины (U+200B), соединители/несоединители (U+200C/U+200D), BOM (U+FEFF), соединитель слов, мягкий дефис и символы управления направлением — с точным количеством каждого типа.
- Следы копирования из ИИ: преобразует «умные» кавычки в прямые, унифицирует тире и удаляет остатки разметки Markdown.
- Очистка пробелов: сжимает повторяющиеся пробелы и пустые строки, убирает лишние пробелы в начале/конце каждой строки.
Почему не попросить ИИ просто всё почистить?
Большие языковые модели читают текст семантически — они, как известно, ненадёжны в точном посимвольном подсчёте и обнаружении Unicode-символов на уровне байтов, это хорошо документированная слабость LLM. Этот инструмент сканирует каждый символ детерминированно, поэтому показанные цифры точны, а не являются предположением ИИ.
Частые вопросы
Вопрос 1: отправляет ли этот инструмент мой текст на сервер?
Нет. Всё обнаружение и очистка происходят локально в вашем браузере — ничего никогда не передаётся, что делает инструмент безопасным для текста с личной или конфиденциальной информацией.
Вопрос 2: не испортит ли нормализация ширины мой китайский/японский/корейский текст?
Нет. Нормализация затрагивает только буквы, цифры и знаки пунктуации в диапазоне ASCII (U+FF01-U+FF5E). Символы, которые естественно имеют полную ширину, например китайские, японские или корейские, остаются без изменений.
Вам также может понадобиться