Масове очищення формату тексту Видаліть змішування повної/половинної ширини, невидимі символи та сліди копіювання з ШІ одним натисканням

Крок 1: вставте текст для очищення

Крок 2: результати виявлення

Ці цифри отримані шляхом точного посимвольного сканування, а не смислової оцінки — саме в цьому ШІ-чати слабкі: вони чудово розуміють зміст тексту, але, як відомо, ненадійні у точному підрахунку символів.

Вставте текст вище, щоб побачити результати виявлення

Крок 3: виберіть, що очищати

Виявляє букви/цифри/символи повної ширини, змішані з текстом половинної ширини (або навпаки), і дозволяє вибрати напрямок нормалізації.

Видаляє пробіли нульової ширини, з'єднувачі, BOM та інші символи, невидимі оку, але шкідливі для пошуку та вигляду.

Виправляє сліди форматування, які часто залишаються при копіюванні з ШІ-чатів.

Стискає повторювані пробіли та порожні рядки, видаляє зайві пробіли на початку/кінці кожного рядка.

Чому вставлений текст іноді виглядає «зламаним»?

Коли ви копіюєте текст із ChatGPT, Word, PDF або перекладених документів, він часто містить символи, невидимі оку, але які комп'ютер все ж обробляє — пробіли нульової ширини, залишки позначки порядку байтів (BOM) або символи керування напрямком тексту. Ці невидимі символи можуть ламати пошук, спотворювати підрахунок символів або навіть спричиняти помилкове виявлення «дубльованого контенту» після вставки в CMS, таблицю чи код. Крім того, ШІ-чати часто залишають стилістичні сліди: «розумні» лапки (“” ‘’), уніфіковані тире (—) та символи розмітки Markdown (**жирний**, # заголовок), призначені для відображення в чаті, а не для вашого документа.

Цей інструмент працює на 100% локально у вашому браузері. Все, що ви вставляєте, ніколи не завантажується на жоден сервер.

Що цей інструмент виявляє та очищає

  • Нормалізація повної/половинної ширини: виявляє букви, цифри та розділові знаки повної ширини, змішані з текстом половинної ширини (або навпаки), і дозволяє привести все до єдиної ширини.
  • Невидимі символи Unicode: знаходить і видаляє пробіл нульової ширини (U+200B), з'єднувачі/нез'єднувачі (U+200C/U+200D), BOM (U+FEFF), з'єднувач слів, м'який дефіс та символи двонапрямленого керування — з точною кількістю кожного типу.
  • Сліди копіювання з ШІ: перетворює «розумні» лапки на прямі, уніфікує тире та видаляє залишки розмітки Markdown.
  • Очищення пробілів: стискає повторювані пробіли та порожні рядки, видаляє зайві пробіли на початку/кінці кожного рядка.

Чому не попросити ШІ просто все очистити?

Великі мовні моделі читають текст семантично — вони, як відомо, ненадійні у точному посимвольному підрахунку та виявленні Unicode на рівні байтів, це добре документована слабкість LLM. Цей інструмент натомість скановує кожен символ детерміновано, тому показані цифри точні, а не припущення ШІ.

Часті запитання

Питання 1: чи завантажує цей інструмент мій текст на сервер?

Ні. Все виявлення та очищення відбувається локально у вашому браузері — нічого ніколи не передається, що робить його безпечним для текстів з особистою чи конфіденційною інформацією.

Питання 2: чи зіпсує нормалізація ширини мій китайський/японський/корейський текст?

Ні. Ця нормалізація впливає лише на букви, цифри та пунктуацію в діапазоні ASCII (U+FF01-U+FF5E). Символи, які природно мають повну ширину, як китайська, японська чи корейська, залишаються незмінними.

Інші корисні інструменти: