Bulanık Tekrar Bulucu Binlerce satırlık listelerde hiçbirini atlamadan benzer kayıtları bulun
Adım 1: Listeyi Yapıştırın veya Yükleyin
💡 Binlerce, hatta on binlerce kayıtlı listeleri destekler — karşılaştırma uzunluk gruplarına bölünerek ilerleme çubuğuyla yapılır, tarayıcı asla kilitlenmez.
.txt (satır başına bir kayıt) veya .csv (her satırın ilk sütunu) desteklenir; yükleme mevcut içeriği değiştirir
Şu anda 0 kayıt girildi
Adım 2: Benzerlik Eşiğini Ayarlayın
Değer yükseldikçe karşılaştırma daha katı olur — yalnızca çok benzer dizeler gruplanır. %80'den başlamanızı öneririz.
⚙️ Performans notu: kayıtlar önce uzunluğa göre güvenli şekilde gruplanır (teorik olarak eşiğe ulaşamayacak çiftler, geçerli bir eşleşmeyi kaçırma riski olmadan atlanır), ardından erken sonlanan Levenshtein mesafesi algoritmasıyla hesaplanarak büyük listelerdeki işlem yükü büyük ölçüde azaltılır. İşlem, sayfanın hiçbir zaman kilitlenmemesi için arka planda bir Web Worker üzerinde çalışır.
Bulanık Tekrar Bulucu nedir?
Bu ücretsiz çevrimiçi araç, büyük listeleri temizlemek için özel olarak tasarlanmıştır. Şirket adlarını, müşteri kayıtlarını, adresleri veya e-postaları yapıştırın veya yükleyin; araç otomatik olarak "birbirine benzeyen ama tam olarak aynı olmayan" kayıtları bulur — örneğin aynı şirketin "Acme Corp.", "Acme Corporation" ve "Acme Crop" olarak üç farklı şekilde yazılması — ve bunları gözden geçirip temizlemenizi kolaylaştırmak için gruplar.
Neden sadece bir AI'ya sormuyoruz?
Birkaç düzine satırlık bir liste için, anlamsal anlayışa sahip bir AI gerçekten belirgin tekrarları tespit edebilir. Ancak liste binlerce, on binlerce satıra ulaştığında, AI'nın tek bir yanıtta her satırı güvenilir şekilde inceleme kapasitesi sınırlıdır — kayıtlar atlanır veya özetlenir. Bu araç, tarayıcınızda gerçek bir ikili karşılaştırma algoritmasını uzunluğa göre ön filtrelemeyle birleştirerek çalıştırır ve her kaydın gerçekten karşılaştırılmasını garanti eder — bu ölçekte salt anlamsal bir AI'nın yapısal olarak veremeyeceği bir güvence.
Karşılaştırma algoritması nasıl çalışır?
Araç, iki dizenin benzerliğini ölçmek için klasik Levenshtein mesafesi algoritmasını kullanır: bir dizeyi diğerine dönüştürmek için gereken minimum ekleme, silme veya değiştirme sayısı ne kadar azsa, ikisi o kadar benzerdir. Bu mesafe %0-100 arası bir benzerlik puanına dönüştürülür ve yalnızca seçtiğiniz eşiğin üzerindeki çiftler bulanık tekrar olarak gruplanır.
Büyük listeler tarayıcıyı kilitlemeden nasıl işlenir?
- Uzunluğa göre ön filtreleme: kayıtlar uzunluğa göre sıralanır; uzunluk farkı çok büyük olan iki dize matematiksel olarak yüksek benzerliğe asla ulaşamaz, bu nedenle gerçek bir eşleşmeyi kaçırma riski olmadan güvenle atlanır.
- Erken sonlanan mesafe hesabı: iki dizenin çok farklı olduğu kesinleşir kesinleşmez karşılaştırma durur, tüm düzenleme mesafesi matrisi hesaplanmaz.
- Arka plan iş parçacığında işleme: hesaplama, gerçek zamanlı ilerleme çubuğuyla bir Web Worker'da çalışır, böylece binlerce satır bile sayfayı kilitlemeden işlenir.
Sıkça Sorulan Sorular (SSS)
S1: Hangi benzerlik eşiğini kullanmalıyım?
Kesin bir cevap yok — %80'den başlayıp gruplar mantıklı mı diye kontrol etmenizi, ardından ayarlamanızı öneririz. Çok düşük bir eşik (%60'ın altı) ilgisiz kayıtları gruplama riski taşır; çok yüksek bir eşik (%95'in üstü) gerçek tekrarları kaçırabilir.
S2: Bu araç listemi bir sunucuya yükler mi?
Hayır. Tüm karşılaştırma tamamen kendi tarayıcınızda gerçekleşir, veri hiçbir zaman bir sunucuya gönderilmez — bu nedenle müşteri bilgisi içeren listeleri güvenle işleyebilirsiniz.
S3: On binlerce satır gerçekten işlenebiliyor mu?
Evet. Uzunluğa göre ön filtreleme ve erken sonlanan mesafe hesabı sayesinde daha büyük listeler sadece biraz daha uzun sürer, ancak her kayıt her zaman eksiksiz olarak karşılaştırılır ve ilerleme çubuğu durumu gösterir.
Bunlara da ihtiyacınız olabilir