Массовая очистка формата текста Удалите смешение полной/половинной ширины, невидимые символы и следы копирования из ИИ одним нажатием

Шаг 1: вставьте текст для очистки

Шаг 2: результаты обнаружения

Эти цифры получены путём точного посимвольного сканирования, а не смысловой оценки — именно с этим у ИИ-чатов плохо: они отлично понимают смысл текста, но, как известно, ненадёжны при точном подсчёте символов.

Вставьте текст выше, чтобы увидеть результаты обнаружения

Шаг 3: выберите, что очищать

Обнаруживает буквы/цифры/символы полной ширины, смешанные с текстом половинной ширины (или наоборот), и позволяет выбрать направление нормализации.

Удаляет пробелы нулевой ширины, соединители, BOM и другие символы, невидимые глазу, но нарушающие поиск и вёрстку.

Исправляет следы форматирования, которые часто остаются при копировании из ИИ-чатов.

Сжимает повторяющиеся пробелы и пустые строки, убирает лишние пробелы в начале/конце каждой строки.

Почему вставленный текст иногда выглядит «сломанным»?

При копировании текста из ChatGPT, Word, PDF или переведённых документов он часто содержит символы, невидимые глазу, но реально обрабатываемые компьютером — пробелы нулевой ширины, остатки метки порядка байтов (BOM) или символы управления направлением текста. Эти невидимые символы могут ломать поиск, портить подсчёт символов и даже вызывать ложные срабатывания «дублированного контента» при вставке в CMS, таблицу или код. Кроме того, ИИ-чаты часто оставляют стилистические следы: «умные» кавычки (“” ‘’), унифицированные длинные тире (—) и символы разметки Markdown (**жирный**, # заголовок), предназначенные для отображения в чате, а не в вашем документе.

Этот инструмент работает на 100% локально в вашем браузере. Всё, что вы вставляете, никогда не отправляется на сервер.

Что этот инструмент обнаруживает и очищает

  • Нормализация полной/половинной ширины: обнаруживает буквы, цифры и символы полной ширины, смешанные с текстом половинной ширины (или наоборот), и позволяет привести всё к единой ширине.
  • Невидимые символы Unicode: находит и удаляет пробел нулевой ширины (U+200B), соединители/несоединители (U+200C/U+200D), BOM (U+FEFF), соединитель слов, мягкий дефис и символы управления направлением — с точным количеством каждого типа.
  • Следы копирования из ИИ: преобразует «умные» кавычки в прямые, унифицирует тире и удаляет остатки разметки Markdown.
  • Очистка пробелов: сжимает повторяющиеся пробелы и пустые строки, убирает лишние пробелы в начале/конце каждой строки.

Почему не попросить ИИ просто всё почистить?

Большие языковые модели читают текст семантически — они, как известно, ненадёжны в точном посимвольном подсчёте и обнаружении Unicode-символов на уровне байтов, это хорошо документированная слабость LLM. Этот инструмент сканирует каждый символ детерминированно, поэтому показанные цифры точны, а не являются предположением ИИ.

Частые вопросы

Вопрос 1: отправляет ли этот инструмент мой текст на сервер?

Нет. Всё обнаружение и очистка происходят локально в вашем браузере — ничего никогда не передаётся, что делает инструмент безопасным для текста с личной или конфиденциальной информацией.

Вопрос 2: не испортит ли нормализация ширины мой китайский/японский/корейский текст?

Нет. Нормализация затрагивает только буквы, цифры и знаки пунктуации в диапазоне ASCII (U+FF01-U+FF5E). Символы, которые естественно имеют полную ширину, например китайские, японские или корейские, остаются без изменений.

Другие полезные инструменты: