欢迎您访问程序员文章站本站旨在为大家提供分享程序员计算机编程知识!
您现在的位置是: 首页  >  IT编程

Java处理不可见特殊字符要点解析

程序员文章站 2022-03-18 16:49:47
看下图所示,两个空字符串不相等因为str中有不可兼得特殊字符,可以在debug中将str的值复制出来,然后粘贴到双引号中们就可以看到这个字符的真面目,如下图所示:\ufeff为控制字符,名为"零宽不折...

看下图所示,两个空字符串不相等

Java处理不可见特殊字符要点解析

因为str中有不可兼得特殊字符,可以在debug中将str的值复制出来,然后粘贴到双引号中们就可以看到这个字符的真面目,如下图所示:

Java处理不可见特殊字符要点解析

\ufeff为控制字符,名为"零宽不折行空格(zero width no-break space)",此外,类似的不可见字符还有\u202a(从左至右嵌入)、\u202e(从右至左强制)等控制字符

那我们事怎么遇到这些控制字符的呢?

在读取文件或者从某文件属性中直接复制路径经常会遇到这种问题

在开发中可以对获得的字符串进行以下处理,来删除这些控制字符:网上很多说使用正则\\p{cntrl}进行替换,经过测试并不起作用,而是用朋友告诉我的\\p{c}

Java处理不可见特殊字符要点解析

string str2 = str1.replaceall("\\p{c}", "");

system.out.println("".equals(str2));

就是一些特殊的unicode字符,如果不确定,可先判断长度是否一样:

Java处理不可见特殊字符要点解析

推荐字符查询网址查询网址:

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。