Công cụ Che giấu & Khôi phục Dữ liệu Cá nhân Ẩn danh trước khi gửi AI, khôi phục một cú nhấp sau đó
Bước 1: Dán văn bản gốc chứa thông tin cá nhân
Lưu ý: chạy lại tự động phát hiện sẽ đặt lại kết quả che giấu và bảng đối chiếu hiện tại. Chỉ đánh dấu thủ công sau khi phát hiện hoàn tất.
Công cụ Che giấu & Khôi phục Dữ liệu Cá nhân là gì?
Ngày càng nhiều người dán nội dung công việc vào ChatGPT, Gemini hoặc Claude để được hỗ trợ, nhưng nội dung đó thường chứa dữ liệu cá nhân thật như email khách hàng, số điện thoại, số CMND/CCCD hay số thẻ tín dụng. Việc dán đồng nghĩa với việc trao dữ liệu đó cho máy chủ của bên thứ ba. Công cụ này tự động phát hiện các định dạng dữ liệu nhạy cảm phổ biến ngay trên trình duyệt của bạn, thay từng dữ liệu bằng mã như [MASK_1] và [MASK_2], và tạo bảng đối chiếu "giá trị gốc ↔ mã" để bạn có thể yên tâm dán "văn bản đã che giấu" vào bất kỳ công cụ AI nào. Khi AI phản hồi (mã thường được trích dẫn nguyên vẹn), hãy dán phản hồi đó vào đây và dùng cùng bảng đối chiếu để khôi phục dữ liệu thật chỉ với một cú nhấp. Đó chính là giá trị cốt lõi của công cụ này: AI có thể giúp bạn che giấu văn bản, nhưng nếu không có bảng đối chiếu thì AI không thể khôi phục được — điều mà AI tự thân không bao giờ làm được.
Các định dạng được hỗ trợ phát hiện
- Địa chỉ email: định dạng email chuẩn.
- Số điện thoại: định dạng quốc tế và địa phương phổ biến.
- Số thẻ tín dụng: 13-19 chữ số kèm dấu phân cách tùy chọn, được xác thực bằng thuật toán Luhn để giảm sai sót.
- Số CMND/CCCD/Hộ chiếu: định dạng SSN của Mỹ, định dạng CMND Đài Loan và định dạng hộ chiếu chữ+số phổ biến.
- Địa chỉ IP: IPv4 và IPv6.
- Tài khoản ngân hàng/IBAN: định dạng số tài khoản ngân hàng quốc tế.
- Đánh dấu thủ công: dữ liệu không có cấu trúc như tên không thể được nhận diện đáng tin cậy chỉ bằng regex, bạn có thể chọn văn bản và thêm thủ công.
Ví dụ trường hợp sử dụng
Ví dụ, trước khi dán email chăm sóc khách hàng vào AI để chỉnh sửa, hãy che giấu tên, email và số điện thoại của khách hàng trước. Hoặc trước khi yêu cầu AI định dạng lại một bảng chứa dữ liệu nhân viên, hãy ẩn danh nó trước. Chỉ cần mã còn giữ nguyên trong phản hồi của AI, bạn có thể khôi phục thành giá trị thật bằng bảng đối chiếu — AI luôn chỉ nhìn thấy mã, không bao giờ thấy dữ liệu cá nhân thật.
Câu hỏi thường gặp (FAQ)
Câu 1: Bảng đối chiếu có được tải lên máy chủ của các bạn không?
Không. Công cụ này hoạt động 100% trên trình duyệt của bạn (Chrome, Firefox, Safari, v.v.) — việc phát hiện, che giấu và khôi phục đều diễn ra tại chỗ. Chúng tôi không có máy chủ backend nhận văn bản của bạn. Bảng đối chiếu chỉ tồn tại trong bộ nhớ của tab hiện tại; nó sẽ biến mất khi bạn làm mới hoặc đóng tab, vì vậy hãy tải xuống nếu muốn giữ lại.
Câu 2: Tại sao không đưa luôn bảng đối chiếu cho AI để nó khôi phục giúp?
Nếu bạn cũng dán bảng đối chiếu vào AI, AI sẽ đồng thời thấy cả mã và giá trị thật, điều này hoàn toàn triệt tiêu mục đích ẩn danh để bảo vệ dữ liệu cá nhân. Bước khôi phục được thiết kế có chủ đích để hoạt động hoàn toàn ngoại tuyến trên thiết bị của bạn, nhằm đảm bảo dữ liệu nhạy cảm thật không bao giờ đi qua máy chủ AI của bên thứ ba.
Câu 3: Việc phát hiện bằng regex có thể bỏ sót hoặc phát hiện sai không?
Có — đây là hạn chế đã biết của phát hiện dựa trên mẫu. Dữ liệu không có cấu trúc như tên hay địa chỉ không thể được xác định đáng tin cậy chỉ dựa vào định dạng. Chúng tôi khuyên bạn nên kiểm tra lại văn bản đã che giấu sau khi phát hiện xong; nếu có phần bị bỏ sót, hãy dùng "Đánh dấu văn bản đã chọn là nhạy cảm" để thêm thủ công.
Câu 4: PII và ẩn danh hóa là gì?
Thông tin định danh cá nhân (Personally Identifiable Information, PII) là bất kỳ dữ liệu nào có thể nhận diện một cá nhân cụ thể, như tên, số CMND hoặc thông tin liên hệ. Ẩn danh hóa (de-identification) thay thế dữ liệu này bằng mã hoặc tên giả để giảm rủi ro rò rỉ. Xem thêm tại Wikipedia: Personal data.