java中文正则

发布时间: 2022-08-03 04:28:03

⑴ java 正则表达式是什么

不同情况下的正则表达式：

匹配首尾空格的正则表达式：(^s*)|(s*$)。
匹配html标签的正则表达式：<(.*)>(.*)</(.*)>|<(.*)/>。
配空行的正则表达式： [s| ]* 。
整数或者小数：^[0-9]+.{0,1}[0-9]{0,2}$。
只能输入数字："^[0-9]*$"。
只能输入n位的数字："^d{n}$"。
只能输入至少n位的数字："^d{n,}$"。
只能输入m~n位的数字：。"^d{m,n}$"
只能输入零和非零开头的数字："^(0|[1-9][0-9]*)$"。
只能输入有两位小数的正实数："^[0-9]+(.[0-9]{2})?$"。
只能输入有1~3位小数的正实数："^[0-9]+(.[0-9]{1,3})?$"。
只能输入非零的正整数："^+?[1-9][0-9]*$"。
只能输入非零的负整数："^-[1-9][]0-9"*$。
只能输入长度为3的字符："^.{3}$"。
只能输入由26个英文字母组成的字符串："^[A-Za-z]+$"。
只能输入由26个大写英文字母组成的字符串："^[A-Z]+$"。
只能输入由26个小写英文字母组成的字符串："^[a-z]+$"。
只能输入由数字和26个英文字母组成的字符串："^[A-Za-z0-9]+$"。
只能输入由数字、26个英文字母或者下划线组成的字符串："^w+$"。
验证用户密码："^[a-zA-Z]w{5,17}$"正确格式为：以字母开头，长度在6~18之间，只能包含字符、数字和下划线。
验证是否含有^%&',;=?$"等字符："[^%&',;=?$x22]+"。
只能输入汉字："^[u4e00-u9fa5]{0,}$"。
验证Email地址："^w+([-+.]w+)*@w+([-.]w+)*.w+([-.]w+)*$"。
验证一年的12个月："^(0?[1-9]|1[0-2])$"正确格式为："01"～"09"和"1"～"12"。
验证一个月的31天："^((0?[1-9])|((1|2)[0-9])|30|31)$"正确格式为；"01"～"09"和"1"～"31"。
匹配中文字符的正则表达式： [u4e00-u9fa5]。
匹配双字节字符(包括汉字在内)：[^x00-xff]。
应用：计算字符串的长度（一个双字节字符长度计2，ASCII字符计1）String.prototype.len=function(){returnthis.replace(/[^x00-xff]/g,"aa").length;}。

⑵ 用JAVA语言编写正则表达式匹配指定的汉字的方法

匹配中文字符的正则表达式：
[\u4e00-\u9fa5]
匹配双字节字符(包括汉字在内)：[^\x00-\xff]
匹配空行的正则表达式：\n[\s
??
]*\r
匹配HTML标记的正则表达式：/
<(.*)>
.*
<\/\1>
??
<(.*)
\/>
/
匹配首尾空格的正则表达式：(^\s*)
??(\s*$)
用正则表达式限制只能输入中文：onkeyup=
"value=value.replace(/[^\u4E00-\u9FA5]/g,
'
')
"
onbeforepaste=
"clipboardData.setData(
'text
',clipboardData.getData(
'text
').replace(/[^\u4E00-\u9FA5]/g,
'
'))
"
用正则表达式限制只能输入全角字符：
onkeyup=
"value=value.replace(/[^\uFF00-\uFFFF]/g,
'
')
"
onbeforepaste=
"clipboardData.setData(
'text
',clipboardData.getData(
'text
').replace(/[^\uFF00-\uFFFF]/g,
'
'))
"

⑶ java正则表达式

正则表达式定义了字符串的模式。
正则表达式可以用来搜索、编辑或处理文本。
正则表达式并不仅限于某一种语言，但是在每种语言中有细微的差别。
Java正则表达式和Perl的是最为相似的。
java.util.regex包主要包括以下三个类：
Pattern类：
pattern对象是一个正则表达式的编译表示。Pattern类没有公共构造方法。要创建一个Pattern对象，你必须首先调用其公共静态编译方法，它返回一个Pattern对象。该方法接受一个正则表达式作为它的第一个参数。
Matcher类：
Matcher对象是对输入字符串进行解释和匹配操作的引擎。与Pattern类一样，Matcher也没有公共构造方法。你需要调用Pattern对象的matcher方法来获得一个Matcher对象。
PatternSyntaxException：
PatternSyntaxException是一个非强制异常类，它表示一个正则表达式模式中的语法错误。

⑷ JAVA正则表达式判断只能包含汉字、英文、“_”和数字，正则该怎么写呢

正则表达式：[\u4e00-\u9fa5]*|\w*|\d*|_*

代码如下：

@Test
public void test1(){
//匹配正则表达式表达式
String str = "[\u4e00-\u9fa5]*|\w*|\d*|_*";
Pattern pattern = Pattern.compile(str);
//要匹配的字符串
String mStr = "还有多远_344fjdk";
System.out.println("测试的字符串:"+mStr);
Matcher m = pattern.matcher(mStr);
//如果匹配到了
if(m.find()){
System.out.println("匹配内容："+m.group());
}
}

程序运行结果：

(4)java中文正则扩展阅读

匹配包括下划线的任何单词字符。类似但不等价于“[A-Za-z0-9_]”，"单词"字符使用Unicode字符集，中文的为：[\u4e00-\u9fa5]，表示英文字母的为w,表示数字的为d,表示_的为_，而*号表示的则是0个或多个，|表示的则是或，所以把每个要匹配的用|拼接可以表示要匹配的正则表达式。

⑸ Java中什么是正则表达式

正则表达式就是将一个类型的数据按照一定方式写成正则表达式的形式这样可以辨别数据是否符合这一类型的数据比如我们的身份证号码就是有一定的规则的这样我们写一个正则表达式和别人输入的身份证号码比对如果符合这个正则表达式的规则就是身份证号码

⑹ java正则表达式怎么书写

正则表达式，又称规则表达式。（英语：Regular Expression，在代码中常简写为regex、regexp或RE），计算机科学的一个概念。正则表达式通常被用来检索、替换那些符合某个模式(规则)的文本。

下面介绍具体的方法。

⑺ 求java编写的各类中文时间识别的正则表达式

各式各样的正则表达式参考大全（访问正则表达式实例库）：
^\d+$//匹配非负整数（正整数 + 0）
//匹配整数 ^\d+(\.\d+)?$//匹配非负浮点数（正浮点数 + 0）
^(([0-9]+\.[0-9]*[1-9][0-9]*)|([0-9]*[1-9][0-9]*\.[0-9]+)|([0-9]*[1-9][0-9]*))$//匹配正浮点数
^((-\d+(\.\d+)?)|(0+(\.0+)?))$//匹配非正浮点数（负浮点数 + 0）
^(-(([0-9]+\.[0-9]*[1-9][0-9]*)|([0-9]*[1-9][0-9]*\.[0-9]+)|([0-9]*[1-9][0-9]*)))$//匹配负浮点数
^(-?\d+)(\.\d+)?$//匹配浮点数
^[A-Za-z]+$ //匹配由26个英文字母组成的字符串
^[A-Z]+$ //匹配由26个英文字母的大写组成的字符串
^[a-z]+$//匹配由26个英文字母的小写组成的字符串
^[A-Za-z0-9]+$//匹配由数字和26个英文字母组成的字符串
^\w+$//匹配由数字、26个英文字母或者下划线组成的字符串
^[\w-]+(\.[\w-]+)*@[\w-]+(\.[\w-]+)+$//匹配email地址
^[a-zA-z]+://匹配(\w+(-\w+)*)(\.(\w+(-\w+)*))*(\?\S*)?$//匹配url
匹配中文字符的正则表达式： [\u4e00-\u9fa5]
匹配双字节字符(包括汉字在内)：[^\x00-\xff]
匹配空行的正则表达式：\n[\s| ]*\r
匹配HTML标记的正则表达式：/<(.*)>.*<\/>|<(.*) \/>/
匹配首尾空格的正则表达式：(^\s*)|(\s*$)
匹配Email地址的正则表达式：\w+([-+.]\w+)*@\w+([-.]\w+)*\.\w+([-.]\w+)*
匹配网址URL的正则表达式：^[a-zA-z]+://(\w+(-\w+)*)(\.(\w+(-\w+)*))*(\?\S*)?$
匹配帐号是否合法(字母开头，允许5-16字节，允许字母数字下划线)：^[a-zA-Z][a-zA-Z0-9_]{4,15}$
匹配国内电话号码：(\d{3}-|\d{4}-)?(\d{8}|\d{7})?
匹配腾讯QQ号：^[1-9]*[1-9][0-9]*$

下表是元字符及其在正则表达式上下文中的行为的一个完整列表，具体到每个正则表达式符号：
\ 将下一个字符标记为一个特殊字符、或一个原义字符、或一个后向引用、或一个八进制转义符。
^ 匹配输入字符串的开始位置。如果设置了 RegExp 对象的Multiline 属性，^ 也匹配 ’\n’ 或 ’\r’ 之后的位置。
$ 匹配输入字符串的结束位置。如果设置了 RegExp 对象的Multiline 属性，$ 也匹配 ’\n’ 或 ’\r’ 之前的位置。
* 匹配前面的子表达式零次或多次。
+ 匹配前面的子表达式一次或多次。+ 等价于 {1,}。
? 匹配前面的子表达式零次或一次。? 等价于 {0,1}。
{n} n 是一个非负整数，匹配确定的n 次。
{n,} n 是一个非负整数，至少匹配n 次。
{n,m} m 和 n 均为非负整数，其中n <= m。最少匹配 n 次且最多匹配 m 次。在逗号和两个数之间不能有空格。
? 当该字符紧跟在任何一个其他限制符 (*, +, ?, {n}, {n,}, {n,m}) 后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜索的字符串。
. 匹配除 "\n" 之外的任何单个字符。要匹配包括 ’\n’ 在内的任何字符，请使用象 ’[.\n]’ 的模式。
(pattern) 匹配pattern 并获取这一匹配。 (?:pattern) 匹配pattern 但不获取匹配结果，也就是说这是一个非获取匹配，不进行存储供以后使用。 (?=pattern) 正向预查，在任何匹配 pattern 的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。 (?!pattern) 负向预查，与(?=pattern)作用相反 x|y 匹配 x 或 y。
[xyz] 字符集合。
[^xyz] 负值字符集合。
[a-z] 字符范围，匹配指定范围内的任意字符。
[^a-z] 负值字符范围，匹配任何不在指定范围内的任意字符。
\b 匹配一个单词边界，也就是指单词和空格间的位置。
\B 匹配非单词边界。
\cx 匹配由x指明的控制字符。
\d 匹配一个数字字符。等价于 [0-9]。
\D 匹配一个非数字字符。等价于 [^0-9]。
\f 匹配一个换页符。等价于 \x0c 和 \cL。
\n 匹配一个换行符。等价于 \x0a 和 \cJ。
\r 匹配一个回车符。等价于 \x0d 和 \cM。
\s 匹配任何空白字符，包括空格、制表符、换页符等等。等价于[ \f\n\r\t\v]。
\S 匹配任何非空白字符。等价于 [^ \f\n\r\t\v]。
\t 匹配一个制表符。等价于 \x09 和 \cI。
\v 匹配一个垂直制表符。等价于 \x0b 和 \cK。
\w 匹配包括下划线的任何单词字符。等价于’[A-Za-z0-9_]’。
\W 匹配任何非单词字符。等价于 ’[^A-Za-z0-9_]’。
\xn 匹配 n，其中 n 为十六进制转义值。十六进制转义值必须为确定的两个数字长。
\num 匹配 num，其中num是一个正整数。对所获取的匹配的引用。
\n 标识一个八进制转义值或一个后向引用。如果 \n 之前至少 n 个获取的子表达式，则 n 为后向引用。否则，如果 n 为八进制数字 (0-7)，则 n 为一个八进制转义值。
\nm 标识一个八进制转义值或一个后向引用。如果 \nm 之前至少有is preceded by at least nm 个获取得子表达式，则 nm 为后向引用。如果 \nm 之前至少有 n 个获取，则 n 为一个后跟文字 m 的后向引用。如果前面的条件都不满足，若 n 和 m 均为八进制数字 (0-7)，则 \nm 将匹配八进制转义值 nm。 \nml 如果 n 为八进制数字 (0-3)，且 m 和 l 均为八进制数字 (0-7)，则匹配八.

⑻ JAVA正则表达式怎么匹配所有中文

/^[\u4e00-\u9fa5]{0,128}$/

/^正则开始 $/正则结束
[/u4e00-/u9fa5] 为中文u码
{0,128} 最少0个，最多128个你自己可以改

⑼ java 正则表达式如何提取中文的问题

String regex="([\u4e00-\u9fa5]+)";
String str="132更新至456";
Matcher matcher = Pattern.compile(regex).matcher(str);
if(matcher.find()){
System.out.println(matcher.group(0));
}

阅读全文

热点内容

曙光牌路由器登录密码是多少发布：2025-03-12 13:51:36 浏览：98

舞蹈培训源码发布：2025-03-12 13:34:04 浏览：741

电脑与服务器之间快速传输文件发布：2025-03-12 13:26:55 浏览：955

ftp上的文件在服务器发布：2025-03-12 13:26:53 浏览：416

linux关闭445端口发布：2025-03-12 13:20:47 浏览：219

加密语句表情发布：2025-03-12 13:17:36 浏览：821

电脑服务器响应不了发布：2025-03-12 13:16:02 浏览：897

vmwarenat外网访问发布：2025-03-12 13:06:31 浏览：47

红魔三哪个安卓系统最稳定发布：2025-03-12 13:01:45 浏览：303

arm嵌入式linux系统发布：2025-03-12 13:01:45 浏览：492

java中文正则

不同情况下的正则表达式：

与java中文正则相关的资讯