批量文字格式标准化清理工具 一键清除全半角混杂、隐形字符与AI复制粘贴痕迹

Step 1:粘贴需要清理的文字

Step 2:检测结果

以下数字是逐字符精确扫描的结果,不是靠语义估算——这正是AI聊天工具本身做不到的部分:AI擅长理解文字含义,但公认不擅长逐字符精确计数。

请先在上方粘贴文字,才能显示检测结果

Step 3:选择要套用的清理项目

检测全角英数字/符号与半角字符混杂的情况,可选择统一转换方向。

移除零宽空格、零宽连字、BOM等肉眼看不到但会造成搜索失效、排版错乱的隐形字符。

修正AI聊天工具复制粘贴时常见的格式痕迹。

压缩多余的连续空白与空行,并清除每行首尾多余空白。

为什么粘贴的文字有时候会“很奇怪”?

从 ChatGPT、Word、PDF 或翻译过的文档复制文字时,常常会夹带肉眼看不见却真实存在的字符——例如零宽空格、文件开头残留的BOM(字节顺序标记),或是文字方向控制符。这些隐形字符平时看不出来,但粘贴进CMS、Excel、代码或表单字段时,可能造成搜索比对失败、字数统计错误,甚至被系统误判为“重复内容”。除此之外,AI聊天工具产出的文字还常带有专属于聊天界面显示用的格式痕迹:智能引号(“” ‘’)、统一的长破折号(—),以及原本用于Markdown渲染的**粗体**# 标题等符号,贴到普通文档里反而显得格式错乱。

本工具100%在你的浏览器内运算,粘贴的文字不会被上传到任何服务器。

本工具检测与清理哪些项目?

  • 全角/半角标准化:检测全角英数字、符号与半角字符混杂的情况,可选择统一转换为半角或全角。
  • 隐形Unicode字符:检测并移除零宽空格(U+200B)、零宽连字/不连字(U+200C/U+200D)、BOM(U+FEFF)、文字连接符、软连字符、文字方向控制符等常见隐形字符,并逐项列出各类型检测到的实际数量。
  • AI复制粘贴痕迹:将智能引号转为标准直引号、统一长短破折号、清除Markdown残留符号(粗体、标题、项目符号、代码标记等)。
  • 多余空白与空行:压缩连续空白与连续空行,清除每行首尾多余的空白。

为什么不直接请AI帮忙清理就好?

大型语言模型是用“理解语义”的方式阅读文字,对于逐字符、逐字节层级的精确计数与检测其实是公认的弱点——你可以请AI“帮我看看这段文字有没有问题”,但很难得到“精确第几个字符是零宽空格、总共有几个”这种确定性答案。本工具改用浏览器原生的逐字符扫描与正则比对,扫描结果是100%精确的统计数字,不是AI凭语感估算出来的。

常见问题 FAQ

Q1:这个工具会不会把我的文字上传到服务器?

不会。所有检测与清理都在你的浏览器本机执行,没有任何文字被传送出去,适合处理包含个人或机密信息的文字内容。

Q2:全角半角标准化会不会把中文字也转掉?

不会。全角/半角标准化只作用在ASCII可视范围内的英数字与符号(U+FF01–U+FF5E),中文、日文、韩文等本身就是全角宽度的文字不会被误判或改动。