Trie树结构

        又称单词查找树,Trie树,是一种树形结构,是一种哈希树的变种。典型应用是用于统计,排序和保存大量的字符串(但不仅限于字符串),所以经常被搜索引擎系统用于文本词频统计。它的优点是:利用字符串的公共前缀来减少查询时间,最大限度地减少无谓的字符串比较,查询效率比哈希表高。

 

 Trie树结构

                    Trie树结构

 

根节点不包含字符,除根节点外每一个节点都只包含一个字符; 从根节点到某一节点,路径上经过的字符连接起来,为该节点对应的字符串; 每个节点的所有子节点包含的字符都不相同。

 

基于字典的中文分词可以使用Trie树来构造中文词典。每个节点存储一个汉字,并在节点处存储状态来标识词语是否结束,来划分单词。

 

 

 

 

 

 

 

 

你可能感兴趣的:(trie)