为啥我必须在 Java 正则表达式中指定整个字符串? [复制]

Posted

技术标签:

【中文标题】为啥我必须在 Java 正则表达式中指定整个字符串? [复制]【英文标题】:Why I must specify whole string in Java regular expression? [duplicate]为什么我必须在 Java 正则表达式中指定整个字符串? [复制] 【发布时间】:2016-11-06 02:25:10 【问题描述】:

假设,我有一个字符串:

String str = "some strange string with searched symbol";

我想在其中搜索一些符号,假设它是"string"。所以我们有以下内容:

str.matches("string"); //false
str.matches(".*string.*"); //true

那么,如标题所述,为什么我必须在 Java 正则表达式中指定整个字符串?

Java 文档说:

公共布尔匹配(字符串正则表达式)

判断这个字符串是否匹配给定的正则表达式。

没有说

判断这个整个字符串是否匹配给定的正则表达式。

例如,在php 中会是:

$str = "some strange string with searched symbol";
var_dump(preg_match('/string/', $str)); // int(1)
var_dump(preg_match('/.*string.*/', $str)); //int(1)

所以,两个正则表达式都是true。 我认为这是正确的,因为如果我想测试整个字符串,我会做str.matches("^string$");

PS:是的,我知道是搜索一个子字符串,更简单更快捷的是使用str.indexOf("string")str.contains("string")。我的问题只涉及 Java 正则表达式。


更新:如@ChrisJester-Young(和@GyroGearless)所述,如果您想搜索作为主题字符串一部分的regex,则其中一种解决方案是使用@987654331像这样的@方法:

    String str = "some strange string with searched symbol";
    Matcher m = Pattern.compile("string").matcher(str);
    System.out.println(m.find()); //true

【问题讨论】:

你可以在if中使用find func。 Matcher 类的 Javadoc 非常清楚:“matches 方法尝试将整个输入序列与模式进行匹配。”​​ Java 在正则表达式部门的非直觉方法命名方面几乎没有问题。例如replace(str, str)replaceAll(str, str)。这两者之间的 only 区别在于replace 不使用正则表达式语法,而replaceAll 使用正则表达式语法并不明显(这两种方法都将替换所有出现或选定的文本)。不幸的是,我们现在所能做的就是接受这一点,犯下我们的错误并最终习惯它。 因为正则表达式“string”与您的测试字符串不匹配。该函数的行为与文档中所说的完全相同。我建议阅读更多关于正则表达式的内容,这应该有助于解决未来的误解。 【参考方案1】:

按照您建议的文档,

公共布尔匹配(字符串正则表达式)

判断这个字符串是否匹配给定的正则表达式。

这意味着该字符串是否与给定的正则表达式匹配。即matches 验证您的字符串是否是给定正则表达式的 instance

not 是否包含作为给定正则表达式的 instance 的子字符串。正如 Chris 建议的那样,您可以改用 find,或者对于您的问题,您可以使用 contains

【讨论】:

【参考方案2】:

是的,您已经知道(现在)matches() 将仅对完整的字符串返回 true。

但是,在您的更新中,您已声明:

正如@ChrisJester-Young(和@GyroGearless)所述,only 解决方案,如果您想搜索作为主题字符串一部分的正则表达式,则使用 find() 方法...

我想说的是,使用find() 不是唯一的解决方案。至少还有一个,我知道:

String str = "some strange string with searched symbol";
boolean found = str.split("string").length>1;
System.out.println(found);

这将打印true。这适用于所有正则表达式。虽然这不是这样做的方法,而是一种 hack。

可能还有更多解决方案。

【讨论】:

我很确定有很多 hacks 可以达到相同的结果 =)。我正在讲述实现这一目标的正确方法。但现在我明白了,那只是我的看法。已删除 =) @spirit 你只删除了唯一的唯一问题?仅有的?好的。仅有的! :P【参考方案3】:

matches 始终匹配整个输入字符串。如果要允许子字符串匹配,请使用find

【讨论】:

你的意思是:Pattern.compile("string").matcher(str).find() ? @spirit 正确。可悲的是,String 类上没有花哨的便利功能。 :-( 同意 =) 如果有 str.find("regex") 方法会更好。 嗯,有indexOf(String) ... . @KevinEsche 是的,但find 在功能方面更接近matches

以上是关于为啥我必须在 Java 正则表达式中指定整个字符串? [复制]的主要内容,如果未能解决你的问题,请参考以下文章

mysql 中用正则表达式如何取一个字符串中指定的字段,

在regex OR组中指定一个组

python 根据python中指定的正则表达式对字符串列表进行分组

java 获取数据库中指定格式的日期

Java学习总计(二十六)——JavaScript正则表达式,Js表单验证,原生js+css页面时钟

为啥必须在 ES2015 中指定导出的类型(let、var、const...)?