Java中正则表达式的一些特殊用法

Wesley13
• 阅读 905

最近在研究数据库迁移工具,阅读源码的过程中学习了一些正则表达式的特殊用法,于是记录一下。

@Test
    public void test() {
        String sql = "CREATE TABLE `test_table` (\n" +
                "  `id` int(11) NOT NULL AUTO_INCREMENT,\n" +
                "  `test_column` int(11) DEFAULT NULL COMMENT '测试字段备注',\n" +
                "  PRIMARY KEY (`id`)\n" +
                ") ENGINE=InnoDB DEFAULT CHARSET=utf8mb4 COLLATE=utf8mb4_unicode_ci COMMENT='测试表备注'";
        String regex = "^\\s*create\\s+table\\s+(?<tableName>\\S+)?[^()]*\\(" +
                "(?<columnSql>[\\s\\S]+)" +
                "\\)[\\s]+" +
                "(engine=(?<tableEngine>\\S+))?" +
                "[\\s]*" +
                "(default charset=(?<tableCharset>\\S+))?" +
                "[\\s]*" +
                "(collate=(?<tableCollate>\\S+))?" +
                "[\\s]*" +
                "(comment=(?<tableComment>\\S+))?" +
                "$";
        Pattern pattern = Pattern.compile(regex, Pattern.CASE_INSENSITIVE);
        Matcher matcher = pattern.matcher(sql);
        if (matcher.find()) {
            System.out.println("tableName:" + matcher.group("tableName"));
            System.out.println("columnSql:" + matcher.group("columnSql"));
            System.out.println("tableEngine:" + matcher.group("tableEngine"));
            System.out.println("tableCharset:" + matcher.group("tableCharset"));
            System.out.println("tableCollate:" + matcher.group("tableCollate"));
            System.out.println("tableComment:" + matcher.group("tableComment"));
        }

    }

输出结果为

tableName:`test_table`
columnSql:
  `id` int(11) NOT NULL AUTO_INCREMENT,
  `test_column` int(11) DEFAULT NULL COMMENT '测试字段备注',
  PRIMARY KEY (`id`)

tableEngine:InnoDB
tableCharset:utf8mb4
tableCollate:utf8mb4_unicode_ci
tableComment:'测试表备注'

搜索发现jdk7之后正则表达式就已经支持了这种写法,而安卓端也有第三方的类库Github地址在几年前提供了支持。

语法:

(?<foo>bar)

英文解释:

Define a named group named "foo" consisting of pattern bar. Matches within the group can be referenced in a replacement using the backreference $foo.

大概意思就是定义一个命名组foo,命名组的匹配规则是bar,这样做还可以使用$foo的形式引用,当然这里也适用其它的正则语法,比如适用: (?:bar) 取消引用降低性能损耗

点赞
收藏
评论区
推荐文章
blmius blmius
3年前
MySQL:[Err] 1292 - Incorrect datetime value: ‘0000-00-00 00:00:00‘ for column ‘CREATE_TIME‘ at row 1
文章目录问题用navicat导入数据时,报错:原因这是因为当前的MySQL不支持datetime为0的情况。解决修改sql\mode:sql\mode:SQLMode定义了MySQL应支持的SQL语法、数据校验等,这样可以更容易地在不同的环境中使用MySQL。全局s
皕杰报表之UUID
​在我们用皕杰报表工具设计填报报表时,如何在新增行里自动增加id呢?能新增整数排序id吗?目前可以在新增行里自动增加id,但只能用uuid函数增加UUID编码,不能新增整数排序id。uuid函数说明:获取一个UUID,可以在填报表中用来创建数据ID语法:uuid()或uuid(sep)参数说明:sep布尔值,生成的uuid中是否包含分隔符'',缺省为
待兔 待兔
6个月前
手写Java HashMap源码
HashMap的使用教程HashMap的使用教程HashMap的使用教程HashMap的使用教程HashMap的使用教程22
Stella981 Stella981
3年前
Opencv中Mat矩阵相乘——点乘、dot、mul运算详解
Opencv中Mat矩阵相乘——点乘、dot、mul运算详解2016年09月02日00:00:36 \牧野(https://www.oschina.net/action/GoToLink?urlhttps%3A%2F%2Fme.csdn.net%2Fdcrmg) 阅读数:59593
Stella981 Stella981
3年前
KVM调整cpu和内存
一.修改kvm虚拟机的配置1、virsheditcentos7找到“memory”和“vcpu”标签,将<namecentos7</name<uuid2220a6d1a36a4fbb8523e078b3dfe795</uuid
Easter79 Easter79
3年前
Twitter的分布式自增ID算法snowflake (Java版)
概述分布式系统中,有一些需要使用全局唯一ID的场景,这种时候为了防止ID冲突可以使用36位的UUID,但是UUID有一些缺点,首先他相对比较长,另外UUID一般是无序的。有些时候我们希望能使用一种简单一些的ID,并且希望ID能够按照时间有序生成。而twitter的snowflake解决了这种需求,最初Twitter把存储系统从MySQL迁移
Wesley13 Wesley13
3年前
00:Java简单了解
浅谈Java之概述Java是SUN(StanfordUniversityNetwork),斯坦福大学网络公司)1995年推出的一门高级编程语言。Java是一种面向Internet的编程语言。随着Java技术在web方面的不断成熟,已经成为Web应用程序的首选开发语言。Java是简单易学,完全面向对象,安全可靠,与平台无关的编程语言。
Stella981 Stella981
3年前
AJPFX总结关于Java中过滤出字母、数字和中文的正则表达式
1、Java中过滤出字母、数字和中文的正则表达式(1)过滤出字母的正则表达式\^(AZaz)\(2)过滤出数字的正则表达式\^(09)\(3)过滤出中文的正则表达式\^(\\\\u4e00\\\\u9fa5)\(4)过滤出字母、数字和中文的正则表达式\^(azAZ09\\\\u
Wesley13 Wesley13
3年前
MySQL部分从库上面因为大量的临时表tmp_table造成慢查询
背景描述Time:20190124T00:08:14.70572408:00User@Host:@Id:Schema:sentrymetaLast_errno:0Killed:0Query_time:0.315758Lock_
Python进阶者 Python进阶者
1年前
Excel中这日期老是出来00:00:00,怎么用Pandas把这个去除
大家好,我是皮皮。一、前言前几天在Python白银交流群【上海新年人】问了一个Pandas数据筛选的问题。问题如下:这日期老是出来00:00:00,怎么把这个去除。二、实现过程后来【论草莓如何成为冻干莓】给了一个思路和代码如下:pd.toexcel之前把这