坎蒂丝_Swan 发表于 2015-1-19 11:00:24

与数据挖掘有关或有帮助的R包和函数的集合

本帖最后由 坎蒂丝_Swan 于 2015-1-19 11:02 编辑

问题导读1.数据挖掘有关或者有帮助的R包有哪些?2.数据挖掘有关或者有帮助的函数有哪些?


static/image/hrline/4.gif

                                                               与数据挖掘有关或者有帮助的R包和函数的集合。
1、聚类常用的包: fpc,cluster,pvclust,mclust基于划分的方法: kmeans, pam, pamk, clara基于层次的方法: hclust, pvclust, agnes, diana基于模型的方法: mclust基于密度的方法: dbscan基于画图的方法: plotcluster, plot.hclust基于验证的方法: cluster.stats
2、分类常用的包:rpart,party,randomForest,rpartOrdinal,tree,marginTree,maptree,survival决策树: rpart, ctree随机森林: cforest, randomForest回归, Logistic回归, Poisson回归: glm, predict, residuals生存分析: survfit, survdiff, coxph
3、关联规则与频繁项集常用的包:arules:支持挖掘频繁项集,最大频繁项集,频繁闭项目集和关联规则DRM:回归和分类数据的重复关联模型APRIORI算法,广度RST算法:apriori, drmECLAT算法: 采用等价类,RST深度搜索和集合的交集: eclat
4、序列模式常用的包: arulesSequencesSPADE算法: cSPADE
5、时间序列常用的包: timsac时间序列构建函数: ts成分分解: decomp, decompose, stl, tsr
6、统计常用的包: Base R, nlme方差分析: aov, anova密度分析: density假设检验: t.test, prop.test, anova, aov线性混合模型:lme主成分分析和因子分析:princomp
7、图表条形图: barplot饼图: pie散点图: dotchart直方图: hist密度图: densityplot蜡烛图, 箱形图 boxplotQQ (quantile-quantile) 图: qqnorm, qqplot, qqlineBi-variate plot: coplot树: rpartParallel coordinates: parallel, paracoor, parcoord热图, contour: contour, filled.contour其他图: stripplot, sunflowerplot, interaction.plot, matplot, fourfoldplot,assocplot, mosaicplot保存的图表格式: pdf, postscript, win.metafile, jpeg, bmp, png
8、数据操作缺失值:na.omit变量标准化:scale变量转置:t抽样:sample堆栈:stack, unstack其他:aggregate, merge, reshape
9、与数据挖掘软件Weka做接口RWeka: 通过这个接口,可以在R中使用Weka的所有算法。



Data 发表于 2015-1-19 11:19:55

感谢分享{:soso_e100:}

hbu126 发表于 2015-1-20 09:18:31

thanks a lot

myejb22 发表于 2015-1-20 09:44:33

{:soso_e179:}
页: [1]
查看完整版本: 与数据挖掘有关或有帮助的R包和函数的集合