lxcnn

正则基础之——反向引用

1 概述

捕获组捕获到的内容，不仅可以在正则表达式外部通过程序进行引用，也可以在正则表达式内部进行引用，这种引用方式就是反向引用。要了解反向引用，首先要了解捕获组，关于捕获组，参考正则基础之——捕获组（capture group）。

反向引用的作用通常是用来查找或限定重复、查找或限定指定标识配对出现等等。

对于普通捕获组和命名捕获组的引用，语法如下：

普通捕获组反向引用：\k<number>，通常简写为\number

命名捕获组反向引用：\k<name>或者\k'name'

普通捕获组反向引用中number是十进制的数字，即捕获组的编号；命名捕获组反向引用中的name为命名捕获组的组名。

2 反向引用匹配原理

捕获组(Expression)在匹配成功时，会将子表达式匹配到的内容，保存到内存中一个以数字编号的组里，可以简单的认为是对一个局部变量进行了赋值，这时就可以通过反向引用方式，引用这个局部变量的值。一个捕获组(Expression)在匹配成功之前，它的内容可以是不确定的，一旦匹配成功，它的内容就确定了，反向引用的内容也就是确定的了。

反向引用必然要与捕获组一同使用的，如果没有捕获组，而使用了反向引用的语法，不同语言的处理方式不一致，有的语言会抛异常，有的语言会当作普通的转义处理。

2.1 从一个简单例子说起

源字符串：abcdebbcde

正则表达式：([ab])\1

对于正则表达式“([ab])\1”，捕获组中的子表达式“[ab]”虽然可以匹配“a”或者“b”，但是捕获组一旦匹配成功，反向引用的内容也就确定了。如果捕获组匹配到“a”，那么反向引用也就只能匹配“a”，同理，如果捕获组匹配到的是“b”，那么反向引用也就只能匹配“b”。由于后面反向引用“\1”的限制，要求必须是两个相同的字符，在这里也就是“aa”或者“bb”才能匹配成功。

考察一下这个正则表达式的匹配过程，在位置0处，由“([ab])”匹配“a”成功，将捕获的内容保存在编号为1的组中，然后把控制权交给“\1”，由于此时捕获组已记录了捕获内容为“a”，“\1”也就确定只有匹配到“a”才能匹配成功，这里显然不满足，“\1”匹配失败，由于没有可供回溯的状态，整个表达式在位置0处匹配失败。

正则引擎向前传动，在位置5之前，“([ab])”一直匹配失败。传动到位置5处时，，“([ab])”匹配到“b”，匹配成功，将捕获的内容保存在编号为1的组中，然后把控制权交给“\1”，由于此时捕获组已记录了捕获内容为“b”，“\1”也就确定只有匹配到“b”才能匹配成功，满足条件，“\1”匹配成功，整个表达式匹配成功，匹配结果为“bb”，匹配开始位置为5，结束位置为7。

扩展一下，正则表达式“([a-z])\1{2}”也就表达连续三个相同的小写字母。

2.2 一个复杂例子的分析

详细的分析讨论参考：正则表达式正向预搜索的问题。

源字符串：aaa bbbb ffffff 999999999

正则表达式：(\w)((?=\1\1\1)(\1))+

测试代码：

string test = "aaa bbbb ffffff 999999999";

Regex reg = new Regex(@"(\w)((?=\1\1\1)(\1))+");

MatchCollection mc = reg.Matches(test);

foreach (Match m in mc)

{

richTextBox2.Text += "匹配结果：" + m.Value.PadRight(12, ' ') + "匹配开始位置：" + m.Index + "\n";

}

//输出

匹配结果：bb 匹配开始位置：4

匹配结果：ffff 匹配开始位置：9

匹配结果：9999999 匹配开始位置：16

匹配结果分析：

正则表达式(\w)((?=\1\1\1)(\1))+从匹配结果上分析，其实就等价于 (\w)(\1)*(?=\1\1\1)(\1) ，这个会相对好理解一些，下面讨论下分析过程。

因为“+”等价于“{1,}”，表示至少匹配1次，下面把子表达式“((?=\1\1\1)(\1))+”展开来看下规律，下表中的“次数”表示子表达式“((?=\1\1\1)(\1))+”匹配成功的次数。

次数	等价表达式
1	(\w)((?=\1\1\1)(\1))
2	(\w)((?=\1\1\1)(\1))((?=\1\1\1)(\1))
3	(\w)((?=\1\1\1)(\1))((?=\1\1\1)(\1))((?=\1\1\1)(\1))
…	…

如果最后一个“((?=\1\1\1)(\1))”匹配成功，那么中间的“((?=\1\1\1)(\1))”一定可以匹配成功，所以中间的限制条件(?=\1\1\1)就没有意义了，这时就可以简写为“(\1)”，也就是

次数	等价表达式
1	(\w)((?=\1\1\1)(\1))
2	(\w)(\1)((?=\1\1\1)(\1))
3	(\w)(\1)(\1)((?=\1\1\1)(\1))
…	…

可以归纳为等价于

(\w)(\1)*((?=\1\1\1)(\1))

因为“((?=\1\1\1)(\1))”开始和结尾的()原来是用作量词+修饰范围的，这里已经没有什么意义了，所以表达式最后可以归纳为等价于

(\w)(\1)*(?=\1\1\1)(\1)

分析这个表达式就容易多了。“(\w)”匹配一个字符，占一位，“\1”是对“\w”匹配内容的引用，“(\1)*”可以匹配0到无穷多个“(\w)”匹配到的字符，“(?=\1\1\1)(\1)”只占一位，但是“(?=\1\1\1)”要求所在位置右侧有三个连续相同的“(\w)”匹配到的字符，所以在“(?=\1\1\1)”这个位置右侧应该有三个字符，不过只有这个位置右侧的一个字符计入最后的匹配结果，最后两个只作为限制条件，不计入最后的匹配结果。

以“999999999”为例，第一个“9”由“(\w)”匹配，第二到第六个“9”由“(\1)*”来匹配，第七个“9”由“(?=\1\1\1)(\1)”中最后的“(\1)”来匹配，而第七、八、九这三个“9”是用来保证满足“(?=\1\1\1)”这个条件的。

2.3 反向引用的编号

对于普通捕获组的反向引用，是通过捕获组的编号来实现的，那么对于一些可能存在歧义的语法又是如何解析的呢？对于正则表达式

([ab])\10

这里的“\10”会被解析成第10个捕获组的反向引用，还是第1个捕获组的反向引用加一个普通字符“0”呢?不同语言的处理方式是不一样的。

string test = "ab0cdebb0cde";

richTextBox2.Text = Regex.Match(test, @"([ab])\10").Value;

在.NET中，以上测试代码输出为空，说明这里的“\10”被解析成第10个捕获组的反向引用，而这个表达式中是不存在第10个捕获组的，所以匹配结果为空。

<script type="text/javascript">

var str = "ab0cdebb0cde";

var reg = /([ab])\10/;

var arr = str.match(reg);

if(arr != null)

    document.write(arr[0]);

</script>

/*--------输出--------

bb0

而在JavaScript中，由于浏览器解析引擎的不同，得到的结果也不一样，以上为IE下是可以得到匹配结果“bb0”，说明在IE的浏览器引擎中，“\10”被解析成第1个捕获组的反向引用加一个普通字符“0”。而在Firefox、Opera等浏览器中，得到的结果为空，说明“\10”被解析成第10个捕获组的反向引用，而这个表达式中是不存在第10个捕获组的。

string test = "ab0cdebb0cde";

richTextBox2.Text = Regex.Match(test, @"([ab])\10", RegexOptions.ECMAScript).Value;

/*--------输出--------

bb0

而在.NET中，如果正则表达式加了RegexOptions.ECMAScript参数，则这里的“\10”被解析成第1个捕获组的反向引用加一个普通字符“0”。

至于正则表达式中确实有10个以上的捕获组时，“\10”的具体意义留给有兴趣的读者去测试了，因为在实际应用当中，如果你的正则表达式中用到了10个以上捕获组，而同时又用到了第10个以上捕获组的反向引用时，就要注意分析一下，你的正则是否需要进行优化，甚至于这里是否适合使用正则表达式了。

出于对现实应用场景的分析，第10个以上捕获组的反向引用几乎不存在，对它的研究通常仅存在于理论上。而对于10个以内捕获组反向引用后面还有数字，容易造成混淆的情况，可以通过非捕获组来解决。

([ab])\1(?:0)

这样就可以明确，是对第1个捕获组的反向引用，后面跟一个普通字符“0”。也就不会产生混淆了。

string test = "ab0cdebb0cde";

richTextBox2.Text = Regex.Match(test, @"([ab])\1(?:0)").Value;

/*--------输出--------

bb0

而事实上，即使是这样用的场景也非常少，至今为止，只在日期正则表达式中用到过。

^(?:(?!0000)[0-9]{4}([-/.]?)(?:(?:0?[1-9]|1[0-2])\1(?:0?[1-9]|1[0-9]|2[0-8])|(?:0?[13-9]|1[0-2])\1(?:29|30)|(?:0?[13578]|1[02])\1(?:31))|(?:[0-9]{2}(?:0[48]|[2468][048]|[13579][26])|(?:0[48]|[2468][048]|[13579][26])00)([-/.]?)0?2\2(?:29))$

这一节讨论的内容，了解一下就可以了，在实际应用当中，如果遇到，注意一下不要出现混淆而导致匹配结果错误就可以了。

3 反向引用应用场景分析

反向引用的作用通常是用来查找或限定重复、查找或限定指定标识配对出现等等。以下以实例进行场景分析及应用讲解。

3.1 查找重复

查找重复通常的应用场景是查找或验证源字符串中，是否有重复单词、重复项等等。

3.1.1 验证数字元素重复项

需求描述：

验证源字符串中以“,”分隔的数字是否有重复项。

代码实现：

string[] test = new string[] { "1,2,3,123,32,13", "12,56,89,123,56,98", "8,2,9,10,38,29,2,9", "8,3,9,238,93,23" };

Regex reg = new Regex(@"\b(\d+)\b.*?\b\1\b");

foreach (string s in test)

{

richTextBox2.Text += "源字符串： " + s.PadRight(20, ' ') + "验证结果： " + reg.IsMatch(s) + "\n";

}

/*--------输出--------

源字符串： 1,2,3,123,32,13 验证结果： False

源字符串： 12,56,89,123,56,98 验证结果： True

源字符串： 8,2,9,10,38,29,2,9 验证结果： True

源字符串： 8,3,9,238,93,23 验证结果： False

源字符串的规则比较明确，就是用“,”分隔的数字，类似于这种查找是否有重复的需求，最简单的就是用反向引用来解决了。

由于要验证的是用“,”分隔的元素的整体是否有重复，所以“(\d+)”两侧的“\b”就是必须的，用来保证取到的数字子串是一个元素整体，而不是“123”中的“1”，当然，这里前后两个“\b”分别换成“(?<!\d)”和“(?!\d)”是一个效果，可能意义上更明确。后面的两个“\b”也是一样的作用。

3.1.2 验证连续数字是否有重复

参考问两个正则表达式。

需求描述：

数据:

1985aaa1985bb

bcae1958fiefadf1955fef

atijc1944cvkd

df2564isdjfef2564d

实现1:匹配第一次出现的四个数字.然后后面也存在这四个数字的

如:

1985aaa1985bb

第一次出现的四个数字是1985.然后后面也存在这四个数字,所以这个匹配

bcae1958fiefadf1955fef

第一次出现的四个数字是1958.然后后面不存在这四个数字.所以不匹配

-----

所以实现1.应该匹配

1985aaa1985bb

df2564isdjfef2564d

代码实现：

//如果是验证第一个出现的连续4个数字是否有重复

string[] test = new string[] { "1985aaa1985bb", "bcae1958fiefadf1955fef", "atijc1944cvkd", "df2564isdjfef2564d", "abc1234def5678ghi5678jkl" };

Regex reg = new Regex(@"^(?:(?!\d{4}).)*(\d{4})(?:(?!\1).)*\1");

foreach (string s in test)

{

richTextBox2.Text += "源字符串： " + s.PadRight(25, ' ') + "验证结果： " + reg.IsMatch(s) + "\n";

}

/*--------输出--------

源字符串： 1985aaa1985bb 验证结果： True

源字符串： bcae1958fiefadf1955fef 验证结果： False

源字符串： atijc1944cvkd 验证结果： False

源字符串： df2564isdjfef2564d 验证结果： True

源字符串： abc1234def5678ghi5678jkl 验证结果： False

由于需求要求验证第一次出现的四个数字是否有重复，所以这里需要用“^(?:(?!\d{4}).)*(\d{4})”来保证捕获组取得的是第一次出现的四个数字。

这样写可能有些复杂，可读性较差，但这里需要用这种顺序环视结合贪婪模式，来达到匹配第一次出现的四个数字的目的，而不能使用非贪婪模式.

对于使用非贪婪模式的正则“^.*?(\d{4})(?:(?!\1).)*\1”，可以看一下它匹配的结果。

string[] test = new string[] { "1985aaa1985bb", "bcae1958fiefadf1955fef", "atijc1944cvkd", "df2564isdjfef2564d", "abc1234def5678ghi5678jkl" };

Regex reg = new Regex(@"^.*?(\d{4})(?:(?!\1).)*\1");

foreach (string s in test)

{

richTextBox2.Text += "源字符串： " + s.PadRight(25, ' ') + "验证结果： " + reg.IsMatch(s) + "\n";

}

/*--------输出--------

源字符串： 1985aaa1985bb 验证结果： True

源字符串： bcae1958fiefadf1955fef 验证结果： False

源字符串： atijc1944cvkd 验证结果： False

源字符串： df2564isdjfef2564d 验证结果： True

源字符串： abc1234def5678ghi5678jkl 验证结果： True

是的，最后一项的验证结果也是“True”，为什么会这样？当捕获组“(\d{4})”匹配到“1234”时，由于“1234”没有重复，所以后面的子表达式匹配失败，此时“.*?”会进行回溯，放弃当前状态，继续向前匹配，直到它匹配到“5678”前的“f”，由捕获组“(\d{4})”匹配到“5678”，后面的子表达式可以匹配成功，报告整个表达式匹配成功。

NFA引擎在有可供回溯的状态时，会一直尝试直到所有可能都尝试失败后才报告失败。上例中非贪婪模式在继续尝试时是可以找到匹配成功的位置的，而采用贪婪模式的正则“^(?:(?!\d{4}).)*(\d{4})”，由于“^(?:(?!\d{4}).)*”匹配到的内容不可能是连续的四个数字，所以无论怎么回溯，接下来的“(\d{4})”都不可能匹配成功，一直回溯到起始位置“^”，报告整个表达式匹配失败。

而后面的顺序环视+贪婪模式子表达式“(?:(?!\1).)*”则不存在以上问题，所以在源字符串比较简单时可以写作“.*?”，不会影响匹配结果。

而对于验证任意位置是否存在四个重复数字，则不需要加起始位置的限定。

//如果是验证任意位置出现的连续4个数字是否有重复，可以用我38楼的正则

string[] test = new string[] { "1985aaa1985bb", "bcae1958fiefadf1955fef", "atijc1944cvkd", "df2564isdjfef2564d", "abc1234def5678ghi5678jkl" };

Regex reg = new Regex(@"(\d{4})(?:(?!\1).)*\1");

foreach (string s in test)

{

richTextBox2.Text += "源字符串： " + s.PadRight(25, ' ') + "验证结果： " + reg.IsMatch(s) + "\n";

}

/*--------输出--------

源字符串： 1985aaa1985bb 验证结果： True

源字符串： bcae1958fiefadf1955fef 验证结果： False

源字符串： atijc1944cvkd 验证结果： False

源字符串： df2564isdjfef2564d 验证结果： True

源字符串： abc1234def5678ghi5678jkl 验证结果： True

3.2 限定指定标识配对

相对于查找重复来说，查找或指定标识配对出现这种应用场景要更多一些。尤其是对于HTML的处理中，这种应用更普遍。

3.2.1 限定标点配对

由于HTML语言的不规范性，导致以下三种写法可以被解析。

1. <a href=www.csdn.net>CSDN</a>

2. <a href='www.csdn.net'>CSDN</a>

3. <a href="www.csdn.net">CSDN</a>

而这对于一些需要进行字符串解析的应用，造成很大的麻烦。在提取链接时，虽然两侧都用“[‘”]?”通常也可以得到正确结果，却不如用反向引用来得严谨、方便。

Regex reg = new Regex(@"(?is)<a(?:(?!href=).)*href=(['""]?)(?<url>[^""'\s>]*)\1[^>]*>(?<text>(?:(?!</a>).)*)</a>");

MatchCollection mc = reg.Matches(yourStr);

foreach (Match m in mc)

{

richTextBox2.Text += m.Groups["url"].Value + "\n";

richTextBox2.Text += m.Groups["text"].Value + "\n";

}

/*--------输出--------

www.csdn.net

CSDN

www.csdn.net

CSDN

www.csdn.net

CSDN

以下可以正确解析出三种形式的HTML代码中的链接和文本，下面把正则改一下

Regex reg = new Regex(@"(?is)<a(?:(?!href=).)*href=(['""])?(?<url>[^""'\s>]*)\1[^>]*>(?<text>(?:(?!</a>).)*)</a>");

看到区别了吗？只是把“([‘””]?)”改成了“([‘””])?”，结果会怎么样呢？

Regex reg = new Regex(@"(?is)<a(?:(?!href=).)*href=(['""])?(?<url>[^""'\s>]*)\1[^>]*>(?<text>(?:(?!</a>).)*)</a>");

MatchCollection mc = reg.Matches(yourStr);

foreach (Match m in mc)

{

richTextBox2.Text += m.Groups["url"].Value + "\n";

richTextBox2.Text += m.Groups["text"].Value + "\n";

}

/*--------输出--------

www.csdn.net

CSDN

www.csdn.net

CSDN

结果只取到了两组数据。这是因为对于情况1的HTML字符串，在“([‘””]?)”这种情况下，捕获组虽然匹配到的只是一个位置，但毕竟是匹配成功了，所以可以用“\1”进行反向引用；而改成“([‘””])?”，捕获组根本就没有进行匹配，所以也就无法进行反向引用。

当然，对于HTML来说，还有一些比较复杂的情况，如

这种复杂情况涉及到的场景比较少，通常应用可以不予以考虑，否则考虑的场景太复杂，会影响匹配效率。写正则的一个一般原则就是，适用就好。这种场景如果遇到，需求根据具体情况，是否需要提取等进行分析，根据分析结果不同，写出的正则也是不一样的。

3.2.2 限定标签配对

这种应用一般是在取某几个特定标签，或是动态生成正则表达式时用到。

需求描述：

删除<script…>…</script>与<style…>…</style>标签及其中间的内容。

代码实现：

Regex reg = new Regex(@"(?is)<(script|style)\b[^>]*>(?(?!\1\b).)*</\1>");

string result = reg.Replace(yourStr, "");

因为这里要删除的标签不止一个，所以事先无法确定是哪个标签，需要用到反向引用来限定标签的配对。

当然，对于标签有嵌套的情况，就要用到平衡组了。可以参考 .NET正则基础之——平衡组。

3.2.3 取配对标签中的内容

需求描述：

[id]5554323[id!][destid]10657302023180404[destid!][srcterminalid]13518841197[srcterminalid!][msgcontent]好的[msgcontent!][receivetime]20090409165217[receivetime!]

源字符串中标签成对出现，无嵌套，分别提取标签和对应的内容。

代码实现：

string test = "[id]5554323[id!][destid]10657302023180404[destid!][srcterminalid]13518841197[srcterminalid!][msgcontent]好的[msgcontent!][receivetime]20090409165217[receivetime!]";

Regex reg = new Regex(@"(?s)\[([^\]]+)\]((?:(?!\[\1).)*)\[\1!\]");

MatchCollection mc = reg.Matches(test);

foreach (Match m in mc)

{

richTextBox2.Text += "Tag: " + m.Groups[1].Value.PadRight(20, ' ') + "Content: " + m.Groups[2].Value + "\n";

}

/*--------输出--------

Tag: id Content: 5554323

Tag: destid Content: 10657302023180404

Tag: srcterminalid Content: 13518841197

Tag: msgcontent Content: 好的

Tag: receivetime Content: 20090409165217

这种需求通常是由捕获组匹配到一个标签，然后向后匹配，直到与之配对的标签外为止，根据源字符串的特点，中间可以使用非贪婪模式，也可以使用顺序否定环视+贪婪模式。

3.3 反向引用的综合应用

3.3.1 12位数字，其中不能出现6位连续相同数字

需求描述：

只允许12位数字，并且其中不能出现6位连续相同数字。

例如，123456789012是允许的，而123333334567是不允许的。

正则表达式：^(?:([0-9])(?!\1{5})){12}$

类似这种需要判定是否有连续相同元素的需求，其实也是验证重复，也要用到反向引用。

说下分析过程，需求分解一下：

1、一个数字

2、它后面不能连续出现5个与它相同的数字

3、满足以上两条的字符一共12个

那么根据需求分解写出相应的正则：

1、([0-9])

2、(?!\1{5})

3、.{12}

将以上三个分解后得出的正则，按需求逻辑关系，组合一下：

(([0-9])(?!\1{5})){12}

由于是验证整个字符串的规则，所以开始和结束标识“^”和“$”是少不了的，不需要用捕获组的地方，用非捕获代替，也就成了最后满足需求的正则：

^(?:([0-9])(?!\1{5})){12}$

其实这个例子的分析过程，也是一些正则问题解析的通用过程，先把复杂的需求由整到零的分解，再各个实现，然后把实现的正则由零到整，考虑一下相互间的逻辑关系，基本上就可以得出正确的正则表达式了。

3.3.2 A-Z以内不重复的10个字母

需求描述：A-Z以内不重复的10个字母

正则表达式1：^(?:([A-Z])(?!.*?\1)){10}$

正则表达式2：^(?:([A-Z])(?=((?!\1).)*$)){10}$

这个需求与上一个需求类似，分析过程也差不多。其实这个问题如果用正则来实现，思路是非常清晰的。

首先因为是验证规则，所以“^”和“$”是必不可少的，分别匹配开始和结束的位置。

然后是10个字母，那么([A-Z]){10}，合起来就是^([A-Z]){10}$ 。

最后就是加一个规则，字母不能重复。

如何保证不能重复，必然是用到反向引用，(一个字母)后面任意一个字母不能与这个字母重复，这样实现起来就有两种方式，当然，实质都是一样的

实现方式一：^(?:([A-Z])(?!.*?\1)){10}$

实现方式二：^(?:([A-Z])(?=(?:(?!\1).)*$)){10}$

在这个需求当中，由于可能出现的源字符串不会太长，也不会太复杂，所以这两个正则表达式在匹配效率上不会有明显的差异。

解释一下正则的含义，先解释一下方式一的正则：

^(?:([A-Z])(?!.*?\1)){10}$

“^”和“$”分别匹配开始和结束位置，“{10}”为量词，表示修饰的子串重复10次。

“(?:Expression)”是非捕获组，目的是不将“()”内的“Expression”匹配的内容保存到内存中，之所以要这样用，是因为后面的反向引用使用的是“\1”，如果不用非捕获组，那么“([A-Z])”就是编号为2的捕获组，后面的“\1”就要换成“\2”，来引用第二个捕获组，替换后对匹配结果当然不会有什么影响，但由于由“(([A-Z])(?!.*?\1))”捕获的内容我们并不关心，所以还是用非捕获组，可以提升匹配效率。

“([A-Z])”就是匹配A到Z之间的任意一个字母，并保存匹配结果到捕获组中。

“(?!.*?\1)”顺序环视，它是零宽度的，虽然进行匹配，但不保存匹配结果，可以理解为它就是在所在位置的右侧附加了一个条件，用在这里表示，它所在位置的右侧，不管间隔多少个字符，都不能出现之前匹配到的那个字符，也就是不能有重复的字母出现。

“(?:([A-Z])(?!.*?\1)){10}”就是匹配到这样一个字符：

1、它首先是一个字母；

2、然后这个字母的右侧间隔任意多个字符，不能再出现同样的字母；

3、最后，符合以上两条规则的字符，一共有10个。

加上首尾限定字符“^”和“$”，就是满足需求的正则。

接下来讨论一下方式二的正则：

^(?:([A-Z])(?=(?:(?!\1).)*$)){10}$

思路和以及其余部分子表达式与方式一完全一样，只有“(?=(?:(?!\1).)*$)”这里不同，这个子表达式表示，它所在位置右侧，一直到结尾，都不能是之前匹配到的那个字符。方式一是非贪婪模式的实现，而这个就是贪婪模式的实现。

这里需要用到顺序肯定环视“(?=Expression)”，而不能用非捕获组“(?:(?:(?!\1).)*$)”，是因为这里的表达式不能占有字符，只能作为条件存在，由量词“{10}”修饰的子表达式最终只能匹配一个字符，否则就无法限定长度了。

3.3.3 提取指定单元长度字符串

需求描述参考求一正则表达式（c# ）：

例如有字符串 string str = "w1w2w3w2w3w1w3w2w4w5w4w5w4w4w5w4w2w4w3w4w3w2w6w5w6w5w6w4w7",找出有且仅有两个单元（w+数字作为一个单元，例如：w1,w2）组成的长度大于等于4个单元的字串（必须包括这两个单元），这个例子，应输出："w2w3w2w3","w4w5w4w5w4w4w5w4","w4w3w4w3","w6w5w6w5w6" 。

如果找出有且仅有三个单元长度大于等于6个单元的字串，该如何写正则表达式？

代码实现：

//第一个需求，两单元的

string str = "w7w7w7w5w7w1w2w3w2w3w1w3w2w4w5w4w5w4w4w5w4w2w4w3w4w3w2w6w5w6w5w6w4w7w7w7w5w7";

MatchCollection mc = Regex.Matches(str, @"(?i)(?=(w\d)\1*(w\d))(?:\1|\2){4,}");

foreach (Match m in mc)

{

richTextBox2.Text += m.Value + "\n";

}

/*--------输出--------

bb0w7w7w7w5w7

w2w3w2w3

w4w5w4w5w4w4w5w4

w4w3w4w3

w6w5w6w5w6

w4w7w7w7

//第二个需求，三单元的

string str = "w7w7w7w5w7w1w2w3w2w3w1w3w2w4w5w4w5w4w4w5w4w2w4w3w4w3w2w6w5w6w5w6w4w7w7w7w5w7";

MatchCollection mc = Regex.Matches(str, @"(?i)(?=(w\d)\1*(w\d)(?:\1|\2)*(w\d))(?:\1|\2|\3){6,}");

foreach (Match m in mc)

{

richTextBox2.Text += m.Value + "\n";

}

/*--------输出--------

bb0w7w7w7w5w7w1

w2w3w2w3w1w3w2

w4w5w4w5w4w4w5w4w2w4

w2w6w5w6w5w6

w4w7w7w7w5w7

这个实例可以认为是环视和反向引用综合运用的一个经典实例。主要是用到了环视零宽度，不占有字符的特性，先由环视来取得规定单元的捕获组的内容，再通过反向引用来进行实际的匹配。

你可能感兴趣的:(JavaScript,html,正则表达式,String,regex,语言)

导师要求一天完成综述，我7分钟搞定——打造一个全本地DeepResearch助手小洛~·~ 人工智能深度学习 chatgpt gpt AI写作
1.项目背景LocalDeepResearcher是一个本地化运行的AI研究助手，旨在通过结合大语言模型（LLM）和搜索工具，实现自动化深度研究并生成结构化报告。该项目由LangChainAI开发，支持本地模型（例如通过Ollama运行的deepseek-r1:7b）和云端模型（例如Claude、GPT），并集成了多种搜索引擎（如Tavily、DuckDuckGo）。其本地优先的设计确保了数据隐私
非结构化文档的自动化敏感标识方法技术解析 KKKlucifer 自动化运维
在数字化时代，企业与组织面临的数据形态正发生深刻变革。据统计，非结构化数据占企业数据总量的80%以上，涵盖文本、邮件、PDF、日志、社交媒体内容等多种形式。这些数据中往往蕴含着大量敏感信息，如个人身份信息、商业机密、医疗记录等，一旦泄露将造成严重的安全风险。然而，非结构化文档缺乏统一的数据模型和格式规范，传统基于结构化数据的敏感信息识别方法难以直接应用，面临着三大核心挑战：语义理解复杂性：自然语言
信息抽取数据集全景分析：分类体系、技术演进与挑战_DEEPSEEK 致Great 分类数据挖掘人工智能
信息抽取数据集全景分析：分类体系、技术演进与挑战摘要信息抽取（IE）作为自然语言处理的核心任务，是构建知识图谱、支持智能问答等应用的基础。近年来，随着深度学习技术的发展和大规模预训练模型的兴起，IE数据集呈现爆发式增长，其分析与评估对模型研发和领域迁移至关重要。本文基于对158个主流IE数据集的系统性梳理，首次提出“信息提取与命名实体识别数据集分类体系”。该体系涵盖8大类别（命名实体识别、关系提取
自然语言处理之文本生成：Recurrent Neural Networks (RNN)：序列模型与语言模型 zhubeibei168 自然语言处理自然语言处理 rnn 语言模型人工智能机器翻译生成对抗网络
自然语言处理之文本生成：RecurrentNeuralNetworks(RNN)：序列模型与语言模型自然语言处理简介NLP的基本概念自然语言处理（NaturalLanguageProcessing，简称NLP）是人工智能领域的一个重要分支&#
Python 可迭代的对象、迭代器和生成器(标准库中的生成器函数) 钢铁男儿流程Python python java 前端
标准库中的生成器函数标准库提供了很多生成器，有用于逐行迭代纯文本文件的对象，还有出色的os.walk函数（https://docs.python.org/3/library/os.html#os.walk）。这个函数在遍历目录树的过程中产出文件名，因此递归搜索文件系统像for循环那样简单。os.walk生成器函数的作用令人赞叹，不过本节专注于通用的函数：参数为任意的可迭代对象，返回值是生成器，用于
Authorization Basic认证笔记从未、淡定 javascript 前端
Basic认证Basic认证过程简单介绍浏览器请求一个需要认证的网页。服务器向浏览器返回“401Unauthorized（未认证）”状态码。浏览器收到此状态码后，询问用户名和密码。浏览器发送附带认证信息（Authorization头信息）的请求。本次请求得到了文档（用户名密码均正确的情况下）。方案1：header添加Authorization原理说明：stringcode=‘fozzie:fozz
[dhtmlx]group task 失效问题解决 oscar999 130-Web语言
1.问题描述使用了Gantt的Group功能，但是在进行系统调优，开启smart_rendering的设置后却出现如下状况：“Groupby时，总有部分task未group”问题细部描述与解决如下：2.Group功能与效果dhtmlxgantt提供了对task根据属性进行分组的功能。效果类似:实现方式的话，首先导入dhtmlxgantt_grouping.js；接下来在代码中处理如下：
Java用CompareTo方法实现根据两个或多个属性对对象进行排序偶遇急雨洗心尘 java jvm 开发语言 servlet 算法
CompareTo方法CompareTo是String类的方法，CompareTo(Objecto1,Objecto2)，就是用o1和o2进行比较o1.compateTo(o2)大于0则o1大o1.compateTo(o2)小于0则o2大o1.compateTo(o2)等于0则一样大升序降序升序：publicstaticvoidmain(String[]args){ArrayListlist=ne
Java中for循环中用break是跳出内层循环还是外层循环偶遇急雨洗心尘 java 算法 jvm 数据结构开发语言
背景：我们知道：for循环中常用“continue”跳过当前循环执行下个循环，常用“break”跳出循环，但是在for循环嵌套中break是仅跳出内层循环还是跳出所有循环呢？测试：publicstaticvoidmain(String[]args){for(inti=0;i<5;i++){for(intj=0;j<5;j++){if(j==3){break;}System.out.println(
GDB调试程序：使用方法和编程技巧程序员拓荒编程
在软件开发过程中，调试是一个至关重要的环节。GDB（GNU调试器）是一个功能强大的调试工具，可以帮助开发人员诊断和修复程序中的错误。本文将介绍GDB的基本用法和一些编程技巧，并提供一些示例源代码供参考。什么是GDB？GDB是一个用于调试程序的命令行工具。它可以帮助开发人员在程序执行过程中定位错误、追踪程序状态以及查看变量的值。GDB支持多种编程语言，包括C、C++、Objective-C、Fort
Spring boot 注解实现幂等性夏壹分享微服务技术体系 java 数据库 spring
1.添加SpringAOP依赖在pom.xml中添加如下依赖：2.创建自定义幂等性注解创建一个新的Java注解类，通过@interface关键字来定义，并可以添加元注解以及属性。/***《像乌鸦一样思考》让孩子学会观察和独立思考！*https://www.sanzhiwa.top/6718.html*/@Retention(RetentionPolicy.RUNTIME)//程序运行时有效@Tar
CSS 伪类详解 lsx202406 开发语言
CSS伪类详解引言在网页设计中，CSS（层叠样式表）是用于描述HTML或XML文档样式的语言。CSS伪类是CSS选择器的一部分，用于指定元素的特定状态。伪类可以让我们为不同的元素状态设置不同的样式，从而实现更加丰富和动态的网页效果。伪类的概述伪类是一种特殊的CSS选择器，它可以用来选择具有特定状态的元素。这些状态可以是用户的交互行为，如鼠标悬停、链接未访问等，也可以是元素的特定位置，如第一个子元素
【Go语言-Day 12】解密动态数组：深入理解 Go 切片 (Slice) 的创建与核心原理吴师兄大模型 Go 语言从入门到精通 golang 开发语言后端 go语言人工智能 LLM python
Langchain系列文章目录01-玩转LangChain：从模型调用到Prompt模板与输出解析的完整指南02-玩转LangChainMemory模块：四种记忆类型详解及应用场景全覆盖03-全面掌握LangChain：从核心链条构建到动态任务分配的实战指南04-玩转LangChain：从文档加载到高效问答系统构建的全程实战05-玩转LangChain：深度评估问答系统的三种高效方法（示例生成、手
多模态大语言模型arxiv论文略读（144）胖头鱼爱算法 #mllm_arxiv 语言模型人工智能自然语言处理论文笔记论文阅读
LARP:TokenizingVideoswithaLearnedAutoregressiveGenerativePrior➡️论文标题：LARP:TokenizingVideoswithaLearnedAutoregressiveGenerativePrior➡️论文作者：HanyuWang,SakshamSuri,YixuanRen,HaoChen,AbhinavShrivastava➡️研究
鸿蒙仓颉语言开发实战教程：购物车页面
合集-仓颉教程(31)1.详解鸿蒙仓颉开发语言中的日志打印问题05-212.鸿蒙仓颉开发语言实战教程：实现商城应用首页05-223.鸿蒙仓颉开发语言实战教程：页面跳转和传参05-254.鸿蒙仓颉语言开发教程：页面和组件的生命周期05-285.鸿蒙仓颉语言开发实战教程：购物车页面06-036.鸿蒙仓颉语言开发实战教程：商城登录页06-047.鸿蒙仓颉语言开发实战教程：商城搜索页06-058.鸿蒙仓颉
机电一体化c语言程序设计,机电一体化专业《C语言程序设计》课程标准爱吃糖的果子狸机电一体化c语言程序设计
山东海事职业学院机电一体化专业《C语言程序设计》课程标准一、课程性质与任务《C语言程序设计》是机电一体化专业的职业能力素质课程之一，并且是本专业的核心专业课程之一，理论性和实践性均较强，既要掌握理论概念，又要动手编程，还要上机调试运行。通过本课程的学习，使学生掌握基本的程序设计过程和技巧，熟练应用MicrosoftVisualC6.0集成环境进行C语言的编写、编译与调试，培养学生的逻辑思维能力、抽
I.MX6ULL ARM裸机开发---C语言LED实验一盆电子 ARM裸机开发 arm c语言驱动开发
一、引言考虑到工作效率，嵌入式驱动开发很少用汇编，大部分是用C语言进行开发。嵌入式驱动开发开始部分就可以用C语言吗？当然不是！在开始部分用汇编来初始化一下C语言环境，比如初始化DDR、设置堆栈指针SP等等，当这些工作都做完以后就可以进入C语言环境，也就是运行C语言代码，一般都是进入main函数。有两部分文件需要完成： 1、汇编文件汇编文件用来完成C语言环境搭建。 2、C语言文件
JAVA：常见 JSON 库的技术详解拾荒的小海螺 JAVA java json 开发语言
1、简述在现代应用开发中，JSON（JavaScriptObjectNotation）已成为数据交换的标准格式。Java提供了多种方式将对象转换为JSON或从JSON转换为对象，常见的库包括Jackson、Gson和org.json。本文将介绍几种常用的JSON处理方式，并通过简单示例展示其应用。2、什么是JSON？JSON是一种轻量级的数据交换格式，使用键值对来表示数据。它易于人阅读和编写，同时
C++字符串和小数类型的转换 Tan_Zhixia c++
字符串->小数代码展示提示：solo为转换的字符串number为返回的小数#includeusingnamespacestd;doubleconvert(stringsolo){//double方法的返回值有小数部分两位数的限制doubleinteger=0;//整数部分(为了相加)stringstrInt="";//整数字符串doubledecimal=0;//小数部分stringstrDeci
C++“inFile”介绍 Tan_Zhixia c++
基础操作介绍inFile需要导入一个叫做fstream的库inFile是输入，但是和cin（输入数据流）不一样，inFile是在写好的文件中进行读取的。格式为：文件名.ininFile的基础代码为：#include#includeusingnamespacestd;stringin;intmain(){ifstreaminFile("文件名.in");//操作文件"文件名.in"并打包到inFil
数据结构循环队列C++实现只需倾听数据结构C++实现 c++数据结构
1.队列的概念队列只允许在表的一端插入，另一端删除。允许插入的一端叫做队尾，允许删除的一端叫做对首。队列的特性叫“先进先出”。和栈一样，队列的存储形式也有两种，基于数组的存储表示和基于链表的存储表示。本文先实现基于数组的存储队列，也叫顺序队列。在顺序队列中设置两个指针，front和rear，front指示队头的位置，rear指示队尾的位置（说是指针，实际仍不是c语言的指针*，而是类似下标或索引的作
使用 Vue3-Ace-Editor 在 Vue3 项目中集成代码编辑器 bigHead- 工具插件编辑器 vue.js 前端 ace.js vue3-ace-editor
在现代Web开发中，集成一个功能强大的代码编辑器能够大大提高应用的互动性和用户体验。AceEditor是一个流行的开源代码编辑器，支持多种编程语言的语法高亮、代码自动补全等功能。而vue3-ace-editor是一个基于AceEditor的Vue组件，方便在Vue3项目中使用AceEditor。下面将介绍如何在Vue3项目中集成和使用vue3-ace-editor。一、安装vue3-ace-edi
LeetCode算法解析：全面掌握编程挑战与面试技能黄浴
本文还有配套的精品资源，点击获取简介：LeetCode作为一个在线编程平台，提供了丰富的算法问题，帮助程序员提升编程技能和面试准备。内容覆盖了多种计算机科学领域，包括数据结构和算法，以及各类编程难题。解决这些问题有助于深化对编程语言、数据结构和算法的理解，并提高系统设计和软件开发能力。本解析可能会包含一个名为“leetcode-master”的开源项目，该项目包含了不同编程语言的LeetCode问
2025年最值得关注的十大OCR模型，技术进化与应用突破全面解析！蜗牛沐雨 ocr 自动化
光学字符识别（OCR）技术已经完成了从“慢、误差高、功能单一”的旧时代，向“快速、精准、多场景全覆盖”的新纪元转变。今天，OCR不再是简单的图像转文本工具，而是支撑智能办公、文档自动化、跨语言内容处理以及视觉理解的核心技术。尤其在2025年，技术格局发生了显著变化：模型更轻量，支持更复杂的文本结构识别，具备强大的多语言和多模态处理能力，能应对实时场景识别甚至复杂的工业图像分析。本文整合了GitHu
推荐几本人工智能方面的书（入门级）人邮异步社区人工智能深度学习神经网络
以下推荐几本适合入门人工智能的书籍，帮助你逐步建立基础知识和理解：一、数学基础类《数学之美》推荐理由：深入浅出地讲解了自然语言处理与搜索方向的数学原理，对于理解算法背后的数学逻辑非常有帮助。本书的章节名称，有“统计语言模型”“谈谈中文分词”“贾里尼克和现代语言处理”“布尔代数和搜索引擎”“信息指纹及其应用”等，似乎太过专业，实际上高中和大学低年级的同学们都能看得懂，当然本书因此也可以称得上是“高级
鸿蒙AI智能问答，助力开发者高效开发 harmonyos
随着鸿蒙生态的快速发展，开发者面临着技术迭代快、知识碎片化的双重挑战。传统开发模式中，开发者需在官网文档、论坛帖子、API参考间反复切换，频繁查阅文档，导致效率低下。与此同时，AI技术的爆发式发展为开发工具智能化提供了新方向。在此背景下，华为在6月21日举办的2025开发者大会（HDC2025）上正式上线了AI智能问答，以自然语言对话为核心交互方式，构建权威、实时、精准的鸿蒙开发知识中枢，重新定义
C#教程（2）———— 各式各样的数据类型值类型篇大朋Sir C#教程 c#
C#教程（2）————各式各样的数据类型前言1数据类型概述2值类型2.1数值类型2.1.1整数类型2.2浮点数类型2.3字符类型2.4布尔类型2.5其它值类型2.6sizeof关键字总结前言在上一篇文章中，我们简单介绍了C#语言的历史，并通过一个简单的打印“HelloWorld”的程序，一起了解了C#程序的基本结构，那么在今天，我们将进一步学习更多的内容。我们的现实生活中总是存在着各式各样的数据，
【C#程序设计】教学讲义——第三章：C#语言基础刘一哥GIS 《GIS程序设计》C#语言基础数据类型变量常量
完整C#教学课件系列：【C#程序设计】教学讲义——第一章：C#语言概述【C#程序设计】教学讲义——第二章：简单C#程序设计【C#程序设计】教学讲义——第三章：C#语言基础文章目录3.1C#程序结构3.2变量和常量3.3常用数据类型3.4运算符和表达式3.1C#程序结构3.1.1组成要素1.关键字在C#代码中常常使用关键字，关键字也叫保留字，是有特定意义的字符串。关键字在VisualStudio.N
JS 与 CSS 的交互式开发：打造灵动的网页体验维他奶糖61 pandas 数据库前端
在当今的网页开发领域，静态的网页早已无法满足用户日益增长的交互需求。JavaScript（JS）和层叠样式表（CSS）作为前端开发的两大支柱，它们的强强联合能够创造出令人惊叹的交互式网页效果。从简单的按钮点击变色，到复杂的动画过渡和动态页面布局变换，JS与CSS的交互式开发赋予了网页生命与活力。接下来，就让我们深入探索这一奇妙的领域。理解JS与CSS的分工与协作在开始交互式开发之前，我们需要明确J
Python 图片爬虫实战：从代码解析到应用技巧维他奶糖61 python 爬虫开发语言
在数字时代，图片资源丰富多样，通过爬虫技术批量获取心仪的图片成为不少人的需求。本文将以爬取彼岸桌面壁纸网4K美女壁纸为例，深入解析Python图片爬虫代码，分享实用技巧，带你轻松掌握图片爬虫技术。一、爬虫实现思路爬虫的核心是模拟浏览器访问网页，解析页面内容，提取所需信息。本次爬虫的流程如下：构建目标网页URL列表，循环访问各页面；发送HTTP请求获取页面内容，解析HTML文档；定位图片元素，提取图
C/C++Win32编程基础详解视频下载择善Zach 编程 C++Win32
课题视频：C/C++Win32编程基础详解视频知识：win32窗口的创建 windows事件机制主讲：择善Uncle老师学习交流群：386620625 验证码：625 --
Guava Cache使用笔记 bylijinnan java guava cache
1.Guava Cache的get/getIfPresent方法当参数为null时会抛空指针异常我刚开始使用时还以为Guava Cache跟HashMap一样，get(null)返回null。实际上Guava整体设计思想就是拒绝null的，很多地方都会执行com.google.common.base.Preconditions.checkNotNull的检查。 2.Guava
解决ora-01652无法通过128（在temp表空间中） 0624chenhong oracle
解决ora-01652无法通过128（在temp表空间中）扩展temp段的过程一个sql语句后，大约花了10分钟，好不容易有一个结果，但是报了一个ora-01652错误，查阅了oracle的错误代码说明：意思是指temp表空间无法自动扩展temp段。这种问题一般有两种原因：一是临时表空间空间太小，二是不能自动扩展。分析过程：既然是temp表空间有问题，那当
Struct在jsp标签不懂事的小屁孩 struct
非UI标签介绍：控制类标签： 1：程序流程控制标签 if elseif else <s:if test="isUsed"> <span class="label label-success">True</span> </
按对象属性排序换个号韩国红果果 JavaScript 对象排序
利用JavaScript进行对象排序，根据用户的年龄排序展示 <script> var bob={ name;bob, age:30 } var peter={ name;peter, age:30 } var amy={ name;amy, age:24 } var mike={ name;mike, age:29 } var john={
大数据分析让个性化的客户体验不再遥远蓝儿唯美数据分析
顾客通过多种渠道制造大量数据，企业则热衷于利用这些信息来实现更为个性化的体验。分析公司Gartner表示，高级分析会成为客户服务的关键，但是大数据分析的采用目前仅局限于不到一成的企业。挑战在于企业还在努力适应结构化数据，疲于根据自身的客户关系管理（CRM）系统部署有效的分析框架，以及集成不同的内外部信息源。然而，面对顾客通过数字技术参与而产生的快速变化的信息，企业需要及时作出反应。要想实
java笔记4 a-john java
操作符 1，使用java操作符操作符接受一个或多个参数，并生成一个新值。参数的形式与普通的方法调用不用，但是效果是相同的。加号和一元的正号（+）、减号和一元的负号（-）、乘号（*）、除号（/）以及赋值号（=）的用法与其他编程语言类似。操作符作用于操作数，生成一个新值。另外，有些操作符可能会改变操作数自身的
从裸机编程到嵌入式Linux编程思想的转变------分而治之：驱动和应用程序 aijuans 嵌入式学习
笔者学习嵌入式Linux也有一段时间了，很奇怪的是很多书讲驱动编程方面的知识，也有很多书将ARM9方面的知识，但是从以前51形式的（对寄存器直接操作，初始化芯片的功能模块）编程方法，和思维模式，变换为基于Linux操作系统编程，讲这个思想转变的书几乎没有，让初学者走了很多弯路，撞了很多难墙。笔者因此写上自己的学习心得，希望能给和我一样转变
在springmvc中解决FastJson循环引用的问题 asialee 循环引用 fastjson
我们先来看一个例子： package com.elong.bms; import java.io.OutputStream; import java.util.HashMap; import java.util.Map; import co
ArrayAdapter和SimpleAdapter技术总结百合不是茶 android SimpleAdapter ArrayAdapter 高级组件基础
ArrayAdapter比较简单，但它只能用于显示文字。而SimpleAdapter则有很强的扩展性，可以自定义出各种效果 ArrayAdapter;的数据可以是数组或者是队列 // 获得下拉框对象 AutoCompleteTextView textview = (AutoCompleteTextView) this
九封信 bijian1013 人生励志
有时候，莫名的心情不好，不想和任何人说话，只想一个人静静的发呆。有时候，想一个人躲起来脆弱，不愿别人看到自己的伤口。有时候，走过熟悉的街角，看到熟悉的背影，突然想起一个人的脸。有时候，发现自己一夜之间就长大了。 2014，写给人
Linux下安装MySQL Web 管理工具phpMyAdmin sunjing PHP Install phpMyAdmin
PHP http://php.net/ phpMyAdmin http://www.phpmyadmin.net Error compiling PHP on CentOS x64 一、安装Apache 请参阅http://billben.iteye.com/admin/blogs/1985244 二、安装依赖包 sudo yum install gd
分布式系统理论 bit1129 分布式
FLP One famous theory in distributed computing, known as FLP after the authors Fischer, Lynch, and Patterson, proved that in a distributed system with asynchronous communication and process crashes,
ssh2整合(spring+struts2+hibernate)-附源码白糖_ eclipse spring Hibernate mysql 项目管理
最近抽空又整理了一套ssh2框架，主要使用的技术如下： spring做容器，管理了三层(dao,service,actioin)的对象 struts2实现与页面交互(MVC)，自己做了一个异常拦截器，能拦截Action层抛出的异常 hibernate与数据库交互 BoneCp数据库连接池，据说比其它数据库连接池快20倍，仅仅是据说 MySql数据库项目用eclipse
treetable bug记录 braveCS table
// 插入子节点删除再插入时不能正常显示。修改： //不知改后有没有错，先做个备忘 Tree.prototype.removeNode = function(node) { // Recursively remove all descendants of +node+ this.unloadBranch(node); // Remove
编程之美-电话号码对应英语单词 bylijinnan java 算法编程之美
import java.util.Arrays; public class NumberToWord { /** * 编程之美电话号码对应英语单词 * 题目： * 手机上的拨号盘，每个数字都对应一些字母，比如2对应ABC，3对应DEF.........，8对应TUV，9对应WXYZ， * 要求对一段数字，输出其代表的所有可能的字母组合
jquery ajax读书笔记 chengxuyuancsdn jQuery ajax
1、jsp页面 <%@ page language="java" import="java.util.*" pageEncoding="GBK"%> <% String path = request.getContextPath(); String basePath = request.getScheme()
JWFD工作流拓扑结构解析伪码描述算法 comsci 数据结构算法工作活动 J#
对工作流拓扑结构解析感兴趣的朋友可以下载附件，或者下载JWFD的全部代码进行分析 /* 流程图拓扑结构解析伪码描述算法 public java.util.ArrayList DFS(String graphid, String stepid, int j)
oracle I/O 从属进程 daizj oracle
I/O 从属进程　　I/O从属进程用于为不支持异步I/O的系统或设备模拟异步I/O.例如，磁带设备(相当慢)就不支持异步I/O.通过使用I/O 从属进程，可以让磁带机模仿通常只为磁盘驱动器提供的功能。就好像支持真正的异步I/O 一样，写设备的进程(调用者)会收集大量数据，并交由写入器写出。数据成功地写出时，写入器(此时写入器是I/O 从属进程，而不是操作系统)会通知原来的调用者，调用者则会
高级排序:希尔排序 dieslrae 希尔排序
public void shellSort(int[] array){ int limit = 1; int temp; int index; while(limit <= array.length/3){ limit = limit * 3 + 1;
初二下学期难记忆单词 dcj3sjt126com english word
kitchen 厨房 cupboard 厨柜 salt 盐 sugar 糖 oil 油 fork 叉；餐叉 spoon 匙；调羹 chopsticks 筷子 cabbage 卷心菜；洋白菜 soup 汤 Italian 意大利的 Indian 印度的 workplace 工作场所 even 甚至；更 Italy 意大利 laugh 笑 m
Go语言使用MySQL数据库进行增删改查 dcj3sjt126com mysql
目前Internet上流行的网站构架方式是LAMP，其中的M即MySQL, 作为数据库，MySQL以免费、开源、使用方便为优势成为了很多Web开发的后端数据库存储引擎。MySQL驱动Go中支持MySQL的驱动目前比较多，有如下几种，有些是支持database/sql标准，而有些是采用了自己的实现接口,常用的有如下几种: http://code.google.c...o-mysql-dri
git命令 shuizhaosi888 git
---------------设置全局用户名： git config --global user.name "HanShuliang" //设置用户名 git config --global user.email "[email protected]" //设置邮箱 ---------------查看环境配置 git config --li
qemu-kvm 网络 nat模式 (四) haoningabc kvm qemu
qemu-ifup-NAT #!/bin/bash BRIDGE=virbr0 NETWORK=192.168.122.0 GATEWAY=192.168.122.1 NETMASK=255.255.255.0 DHCPRANGE=192.168.122.2,192.168.122.254 TFTPROOT= BOOTP= function check_bridge()
不要让未来的你，讨厌现在的自己 jingjing0907 生活奋斗工作梦想
故事one 　23岁，他大学毕业，放弃了父母安排的稳定工作，独闯京城，在家小公司混个小职位，工作还算顺手，月薪三千，混了混，混走了一年的光阴。　　　　24岁，有了女朋友，从二环12人的集体宿舍搬到香山民居，一间平房，二人世界，爱爱爱。偶然约三朋四友，打扑克搓麻将，日子快乐似神仙；　　　　25岁，出了几次差，调了两次岗，薪水涨了不过百，生猛狂飙的物价让现实血淋淋，无力为心爱银儿购件大牌
枚举类型详解一路欢笑一路走 enum 枚举详解 enumset enumMap
枚举类型详解一.Enum详解 1.1枚举类型的介绍 JDK1.5加入了一个全新的类型的”类”—枚举类型，为此JDK1.5引入了一个新的关键字enum,我们可以这样定义一个枚举类型。 Demo:一个最简单的枚举类 public enum ColorType { RED
第11章动画效果（上） onestopweb 动画
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
Eclipse中jsp、js文件编辑时，卡死现象解决汇总 ljf_home eclipse jsp卡死 js卡死
使用Eclipse编辑jsp、js文件时，经常出现卡死现象，在网上百度了N次，经过N次优化调整后，卡死现象逐步好转，具体那个方法起到作用，不太好讲。将所有用过的方法罗列如下： 1、取消验证 windows–>perferences–>validation 把除了manual 下面的全部点掉，build下只留 classpath dependency Valida
MySQL编程中的6个重要的实用技巧 tomcat_oracle mysql
每一行命令都是用分号(;)作为结束对于MySQL，第一件你必须牢记的是它的每一行命令都是用分号(;)作为结束的，但当一行MySQL被插入在PHP代码中时，最好把后面的分号省略掉，例如： mysql_query("INSERT INTO tablename(first_name,last_name)VALUES('$first_name',$last_name')");
zoj 3820 Building Fire Stations(二分+bfs) 阿尔萨斯 Build
题目链接：zoj 3820 Building Fire Stations 题目大意：给定一棵树，选取两个建立加油站，问说所有点距离加油站距离的最大值的最小值是多少，并且任意输出一种建立加油站的方式。解题思路：二分距离判断，判断函数的复杂度是o(n)，这样的复杂度应该是o(nlogn)，即使常数系数偏大，但是居然跑了4.5s，也是醉了。判断函数里面做了3次bfs，但是每次bfs节点最多