使用FP-growth算法来高效发现频繁项集

版权声明:本文为博主原创文章,未经博主允许不得转载。 https://blog.csdn.net/QFire/article/details/78171764

  在搜索引擎中输入一个单词或者单词的一部分,就会自动补全查询词项

  FP-growd基于Apriori构建,但在完成相同任务时采用了一些不同的技术.这里的任务是将数据集存储在一个特定的称作FP树的结构之后发现频繁项集或频繁项对,即常在一块出现的元素项的集合FP树.这种做法是的算法的执行速度要快于Apriori,通常性能要好两个数量级以上.

一,FP树

    频繁模式(Frequent Pattern)    

二,构建FP树


三,从一颗FP树中挖掘频繁项集


四,示例:在Twitter源中发现一些共现词


五,示例:从新闻网站点击流中挖掘



展开阅读全文

没有更多推荐了,返回首页