Java 处理不可见特殊字符的坑

Posted 龙谷情

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了Java 处理不可见特殊字符的坑相关的知识,希望对你有一定的参考价值。

看下图所示,两个空字符串不相等

因为str中有不可兼得特殊字符,可以在debug中将str的值复制出来,然后粘贴到双引号中们就可以看到这个字符的真面目,如下图所示:

\\uFEFF为控制字符,名为"零宽不折行空格(Zero Width No-Break Space)",此外,类似的不可见字符还有\\u202A(从左至右嵌入)、\\u202E(从右至左强制)等控制字符

那我们事怎么遇到这些控制字符的呢?

在读取文件或者从某文件属性中直接复制路径经常会遇到这种问题

 

在开发中可以对获得的字符串进行以下处理,来删除这些控制字符:网上很多说使用正则\\\\p{Cntrl}进行替换,经过测试并不起作用,而是用朋友告诉我的\\\\p{C}

        String str2 = str1.replaceAll("\\\\p{C}", "");
        System.out.println("".equals(str2));

就是一些特殊的Unicode字符,如果不确定,可先判断长度是否一样:

 

推荐字符查询网址查询网址:

https://unicode-table.com/cn/

 

以上是关于Java 处理不可见特殊字符的坑的主要内容,如果未能解决你的问题,请参考以下文章

C语言宏的特殊用法和几个坑 (转)

Char.toString没有特殊处理“和

Java不可见字符处理

检测后退按钮但不关闭对话框片段

重新创建活动后片段不可见

方向更改时不可见的片段