Toplu Metin Biçimi Temizleyici Tam/yarım genişlik karışıklığını, görünmez karakterleri ve yapay zeka kopyalama izlerini bir tıkla kaldırın

Adım 1: Temizlenecek metni yapıştırın

Adım 2: Algılama sonuçları

Bu sayılar, anlamsal bir tahminden değil, karakter karakter yapılan kesin bir taramadan gelir — yapay zeka sohbet araçlarının zayıf olduğu tam da bu noktadır: metnin anlamını anlamakta çok iyidirler, ancak karakterleri kesin olarak saymakta güvenilmez olduğu bilinir.

Algılama sonuçlarını görmek için yukarıya metin yapıştırın

Adım 3: Uygulanacak temizlik öğelerini seçin

Yarım genişlikli metne karışmış tam genişlikli harf/sayı/sembolleri (veya tersini) algılar ve normalleştirme yönünü seçmenizi sağlar.

Göze görünmeyen ama aramayı ve düzeni bozan sıfır genişlikli boşlukları, birleştiricileri, BOM'u ve diğer karakterleri kaldırır.

Yapay zeka sohbet araçlarından kopyalarken sıkça kalan biçimlendirme izlerini düzeltir.

Tekrarlanan boşlukları ve boş satırları sıkıştırır, her satırın başındaki/sonundaki gereksiz boşlukları kaldırır.

Yapıştırılan metin bazen neden "bozuk" görünür?

ChatGPT, Word, PDF veya çevrilmiş belgelerden metin kopyaladığınızda, genellikle göze görünmeyen ama bilgisayar tarafından hâlâ işlenen karakterler taşır — sıfır genişlikli boşluklar, kalan bayt sıralama işareti (BOM) veya yön kontrol işaretleri. Bu görünmez karakterler aramayı bozabilir, karakter sayımını yanlış yapabilir, hatta CMS, e-tablo veya koda yapıştırıldığında yanlış "yinelenen içerik" tespitine yol açabilir. Ayrıca yapay zeka sohbet araçları genellikle biçimsel izler bırakır: akıllı tırnak işaretleri (“” ‘’), birleştirilmiş uzun tireler (—) ve sohbet görüntüsü için tasarlanmış Markdown sembolleri (**kalın**, # başlık).

Bu araç %100 yerel olarak tarayıcınızda çalışır. Yapıştırdığınız hiçbir şey herhangi bir sunucuya yüklenmez.

Bu araç ne algılar ve neyi temizler

  • Tam/yarım genişlik normalizasyonu: yarım genişlikli metne karışmış tam genişlikli harf, sayı ve noktalama işaretlerini (veya tersini) algılar ve her şeyi tek bir genişliğe dönüştürmenizi sağlar.
  • Görünmez Unicode karakterler: sıfır genişlikli boşluk (U+200B), birleştirici/birleştirmeyen (U+200C/U+200D), BOM (U+FEFF), kelime birleştirici, yumuşak tire ve yön kontrol işaretlerini bulur ve kaldırır — her tür için tam sayıyı gösterir.
  • Yapay zeka kopyalama izleri: akıllı tırnak işaretlerini düz tırnaklara dönüştürür, tireleri birleştirir ve kalan Markdown sembollerini kaldırır.
  • Boşluk temizliği: tekrarlanan boşlukları ve boş satırları sıkıştırır, her satırın başındaki/sonundaki gereksiz boşlukları kaldırır.

Neden bunu bir yapay zekaya temizletmiyoruz?

Büyük dil modelleri metni anlamsal olarak okur — karakterleri tam olarak saymakta ve bayt düzeyinde Unicode tespitinde güvenilmez oldukları iyi bilinir, bu LLM'lerin belgelenmiş bir zayıflığıdır. Bu araç bunun yerine her karakteri deterministik olarak tarar, böylece gösterilen sayılar bir yapay zekanın tahmini değil, kesindir.

Sıkça sorulan sorular

S1: Bu araç metnimi bir sunucuya yüklüyor mu?

Hayır. Tüm algılama ve temizleme tarayıcınızda yerel olarak gerçekleşir — hiçbir şey asla gönderilmez, bu da kişisel veya gizli bilgi içeren metinler için güvenli olmasını sağlar.

S2: Tam/yarım genişlik normalizasyonu Çince/Japonca/Korece metnimi bozar mı?

Hayır. Bu normalizasyon yalnızca ASCII aralığındaki harfleri, sayıları ve noktalama işaretlerini (U+FF01-U+FF5E) etkiler. Çince, Japonca veya Korece gibi doğal olarak tam genişlikli karakterler değişmeden kalır.