批量文字格式標準化清理工具 一鍵清除全半角混雜、隱形字元與AI複製貼上痕跡

Step 1:貼上待清理的文字

Step 2:偵測結果

以下數字是逐字元精確掃描的結果,不是用語意估算——這正是AI聊天工具本身做不到的部分:AI擅長理解文字意思,但公認不擅長逐字元精確計數。

請先在上方貼上文字,才能顯示偵測結果

Step 3:選擇要套用的清理項目

偵測全形英數字/符號與半形字元混雜的情況,可選擇統一轉換方向。

移除零寬空格、零寬連字、BOM等肉眼看不到但會造成搜尋失效、排版跑掉的隱形字元。

修正AI聊天工具複製貼上時常見的格式痕跡。

壓縮多餘的連續空白與空行,並清除每行首尾多餘空白。

為什麼貼上的文字有時候會「怪怪的」?

從 ChatGPT、Word、PDF 或翻譯過的文件複製文字時,常常會夾帶肉眼看不到卻真實存在的字元——例如零寬空格、檔案開頭殘留的BOM(Byte Order Mark)記號,或是文字方向控制符。這些隱形字元平時看不出來,但貼進CMS、Excel、程式碼或表單欄位時,可能造成搜尋比對失敗、字數計算錯誤,甚至讓系統誤判為「重複內容」。除此之外,AI聊天工具產出的文字還常帶有專屬於聊天介面顯示用的格式痕跡:智慧引號(“” ‘’)、統一的長破折號(—),以及原本用於Markdown渲染的**粗體**# 標題等符號,這些貼到一般文件裡反而顯得格式錯亂。

本工具100%在你的瀏覽器內運算,貼上的文字不會被上傳到任何伺服器。

本工具偵測與清理哪些項目?

  • 全形/半形標準化:偵測全形英數字、符號與半形字元混雜的情況,可選擇統一轉換為半形或全形。
  • 隱形Unicode字元:偵測並移除零寬空格(U+200B)、零寬連字/不連字(U+200C/U+200D)、BOM(U+FEFF)、文字連接符、軟連字號、文字方向控制符等常見隱形字元,並逐項列出各類型偵測到的實際數量。
  • AI複製貼上痕跡:將智慧引號轉為標準直引號、統一長短破折號、清除Markdown殘留符號(粗體、標題、項目符號、程式碼標記等)。
  • 多餘空白與空行:壓縮連續空白與連續空行,清除每行首尾多餘的空白。

為什麼不直接請AI幫忙清理就好?

大型語言模型是用「理解語意」的方式閱讀文字,對於逐字元、逐位元組層級的精確計數與偵測其實是公認的弱點——你可以請AI「幫我看看這段文字有沒有問題」,但很難得到「精確第幾個字元是零寬空格、總共有幾個」這種確定性答案。本工具改用瀏覽器原生的逐字元掃描與正則比對,掃描結果是100%精確的統計數字,不是AI憑語感估算出來的。

常見問題 FAQ

Q1:這個工具會不會把我的文字上傳到伺服器?

不會。所有偵測與清理都在你的瀏覽器本機執行,沒有任何文字被傳送出去,適合處理包含個人或機密資訊的文字內容。

Q2:全形半形標準化會不會把中文字也轉掉?

不會。全形/半形標準化只作用在ASCII可視範圍內的英數字與符號(U+FF01–U+FF5E),中文、日文、韓文等本身就是全形寬度的文字不會被誤判或改動。

Q3:清除Markdown符號會不會誤刪我原本就想保留的星號或井字號?

Markdown殘留符號清除是可獨立勾選、關閉的選項,若你的文字本來就包含程式碼片段或需要保留符號的內容,建議先取消勾選這一項,只套用其他清理項目。