我正在寻找数据挖掘中的关联规则挖掘。有三种类型的频繁项集
若要生成关联规则,应使用频繁项集或关闭频繁项集(频繁项集可与闭频繁项集一起找到)。
寻找最大频繁项目集的算法很多(黑手党,最大-Miner,深度计划,GenMax .)
寻找最大频繁项集的优点是什么?主要的想法是什么?
谢谢。
发布于 2014-12-22 13:32:40
主要的想法是,当寻找低支持的长项目集时,你最终会用频繁但不有趣的、冗余的和简短的项目集来耗尽你所有的记忆。
为了体验这一点,获取一些大的、真实的数据并对其进行项集挖掘,而不是在讲座中使用玩具示例。
发布于 2015-01-07 05:32:43
当数据集的大小和数据集中频繁项集的数量很大时,找出所有频繁项集是不可行的。求最大频繁项集(MFI)的优点是:
https://stackoverflow.com/questions/27600310
复制相似问题