admin 发表于 2015-7-14 12:39:30

与数据挖掘有关或者有帮助的R包和函数的集合

1、聚类常用的包: fpc,cluster,pvclust,mclust基于划分的方法: kmeans, pam, pamk, clara基于层次的方法: hclust, pvclust, agnes, diana基于模型的方法: mclust基于密度的方法: dbscan基于画图的方法: plotcluster, plot.hclust基于验证的方法: cluster.stats 2、分类常用的包:rpart,party,randomForest,rpartOrdinal,tree,marginTree,maptree,survival决策树: rpart, ctree随机森林: cforest, randomForest回归, Logistic回归, Poisson回归: glm, predict, residuals生存分析: survfit, survdiff, coxph 3、关联规则与频繁项集常用的包:arules:支持挖掘频繁项集,最大频繁项集,频繁闭项目集和关联规则DRM:回归和分类数据的重复关联模型APRIORI算法,广度RST算法:apriori, drmECLAT算法: 采用等价类,RST深度搜索和集合的交集: eclat 4、序列模式常用的包: arulesSequencesSPADE算法: cSPADE5、时间序列常用的包: timsac时间序列构建函数: ts成分分解: decomp, decompose, stl, tsr 6、统计常用的包: Base R, nlme方差分析: aov, anova密度分析: density假设检验: t.test, prop.test, anova, aov线性混合模型:lme主成分分析和因子分析:princomp 7、图表条形图: barplot饼图: pie散点图: dotchart直方图: hist密度图: densityplot蜡烛图, 箱形图 boxplotQQ (quantile-quantile) 图: qqnorm, qqplot, qqlineBi-variate plot: coplot树: rpartParallel coordinates: parallel, paracoor, parcoord热图, contour: contour, filled.contour其他图: stripplot, sunflowerplot, interaction.plot, matplot, fourfoldplot,assocplot, mosaicplot保存的图表格式: pdf, postscript, win.metafile, jpeg, bmp, png 8、数据操作缺失值:na.omit变量标准化:scale变量转置:t抽样:sample堆栈:stack, unstack其他:aggregate, merge, reshape 9、与数据挖掘软件Weka做接口RWeka: 通过这个接口,可以在R中使用Weka的所有算法。 转自:http://www.pluscn.net/?p=1548
页: [1]
查看完整版本: 与数据挖掘有关或者有帮助的R包和函数的集合