数据结构之AC自动机

自动机 构造 过程:

根据模式串构造Trie树;BFS创建失败指针。 所谓失败指针类似于KMP中的next数组,当主串在Trie上进行匹配时,如果当前节点不能继续匹配时,就应当退回到当前节点的失败指针所指向的节点。在这里主要说下失败指针的构造:首先与根直接相邻的点的失败指针指向根节点,并入队列;设当前节点p1的子节点c1含字符C,沿着这个节点的失败指针走,一直走到某个节点p2,它的某个子节点c2含也字符C,那么把c1的失败指针指向c2,其含义是c1所代表的串的后缀和c2所代表的串的前缀相等且相同部分最长。

自动机查询过程:

当前主串的字符和Trie树上的匹配,看这个节点是否是某个串的结束标志,若是,记录这个节点(注意,还要继续根据该节点的失败指针继续查找,这是因为它的后缀也有可能是模式串,比如在找串yashe中,she和he是两个模式串,它会先找到she,再找到he)。然后沿着路径继续向下走,继续匹配下一个字符;若当前字符不匹配,则去当前节点的失败指针继续寻找;重复这两者中的任意一个,直到主串走到结尾为止。 

算法复杂度:O(m+n+z),其中z为主串中模式串的总个数

KMP做多模式匹配, 复杂度为O(m+k1+m+k2+...m+kk)=(n+km),k为模式串个数,n=sigma(ki),即模式串的总长度之和。

你可能感兴趣的:(数据结构,算法)