大小:41.88M
更新时间:23-08-16
系统:Pc
r语言数据分析与挖掘实战是一本由10余位数据挖掘领域资深专家和科研人员0余年大数据挖掘咨询与实施经验结晶,由张良均,云伟标,王路,刘晓勇四人编著。全书以数据挖掘的应用出发,以电力、航空、医疗等10个行业真实案例为主线,详细讲解了R数据挖掘建模的过程和数据挖掘的二次开发。全书以大家熟知的数据挖掘建模工具R语言来展开,以解决某个应用的挖掘目标为前提,先介绍案例背景提出挖掘目标,再阐述分析方法与过程,最后完成模型构建,在介绍建模过程中同时穿插操作训练,把相关的知识点嵌入相应的操作过程中,使读者轻松理解并掌握相关的理论和知识点。
《R语言数据分析与挖掘实战》是一本系统性的、以实践为导向的R数据挖掘与分析实战指南,多位技术专家结合自己10多年的经验,以电力、航空、医疗、互联网、制造业等10个行业的实战案例为主线,深入浅出地讲解了如何利用R语言及其相关技术进行数据挖掘建模、数据分析和二次开发,不仅为多个行业提供了成熟的解决方案,而且还提供了大量的技巧。
本书共16章,分三个部分:
基础篇(第1~5章),第1章的主要内容是数据挖掘概述;第2章对本书所用到的数据挖掘建模工具R语言进行了简明扼要的说明;第3、4、5章对数据挖掘的建模过程,包括数据探索、数据预处理及挖掘建模的常用算法与原理进行了介绍。
实战篇(第6~15章),重点对数据挖掘技术在电力、航空、医疗、互联网、生产制造以及公共服务等行业的应用进行了分析。在案例结构组织上,本书是按照先介绍案例背景与挖掘目标,再阐述分析方法与过程,最后完成模型构建的顺序进行的,在建模过程等关键环节,穿插程序实现代码。最后通过上机实践,加深数据挖掘技术在案例应用中的理解。
高级篇(第16章),介绍了基于R语言二次开发的数据挖掘应用软件——TipDM数据挖掘建模工具,并以此工具为例详细介绍了基于R语言完成数据挖掘二次开发的各个步骤,使读者体验到通过R语言实现数据挖掘二次开发的强大魅力。
前 言 基 础 篇 第1章 数据挖掘基础2 1.1 某知名连锁餐饮企业的困惑2 1.2 从餐饮服务到数据挖掘3 1.3 数据挖掘的基本任务4 1.4 数据挖掘建模过程4 1.4.1 定义挖掘目标4 1.4.2 数据取样5 1.4.3 数据探索6 1.4.4 数据预处理7 1.4.5 挖掘建模7 1.4.6 模型评价7 1.5 常用数据挖掘建模工具7 1.6 小结9 第2章 R语言简介10 2.1 R安装10 2.2 R使用入门11 2.2.1 R操作界面11 2.2.2 RStudio窗口介绍12 2.2.3 R常用操作13 2.3 R数据分析包16 2.4 配套附件使用设置18 2.5 小结18 第3章 数据探索19 3.1 数据质量分析19 3.1.1 缺失值分析20 3.1.2 异常值分析20 3.1.3 一致性分析22 3.2 数据特征分析23 3.2.1 分布分析23 3.2.2 对比分析25 3.2.3 统计量分析27 3.2.4 周期性分析29 3.2.5 贡献度分析30 3.2.6 相关性分析31 3.3 R语言主要数据探索函数35 3.3.1 统计特征函数35 3.3.2 统计作图函数37 3.4 小结40 第4章 数据预处理41 4.1 数据清洗42 4.1.1 缺失值处理42 4.1.2 异常值处理45 4.2 数据集成45 4.2.1 实体识别46 4.2.2 冗余属性识别46 4.3 数据变换46 4.3.1 简单函数变换46 4.3.2 规范化47 4.3.3 连续属性离散化48 4.3.4 属性构造51 4.3.5 小波变换52 4.4 数据规约55 4.4.1 属性规约55 4.4.2 数值规约58 4.5 R语言主要数据预处理函数61 4.6 小结65 第5章 挖掘建模66 5.1 分类与预测66 5.1.1 实现过程66 5.1.2 常用的分类与预测算法67 5.1.3 回归分析68 5.1.4 决策树73 5.1.5 人工神经网络79 5.1.6 分类与预测算法评价83 5.1.7 R语言主要分类与预测算法函数87 5.2 聚类分析89 5.2.1 常用聚类分析算法89 5.2.2 KMeans聚类算法90 5.2.3 聚类分析算法评价95 5.2.4 R语言主要聚类分析算法函数95 5.3 关联规则97 5.3.1 常用关联规则算法97 5.3.2 Apriori算法98 5.4 时序模式102 5.4.1 时间序列算法103 5.4.2 时间序列的预处理104 5.4.3 平稳时间序列分析105 5.4.4 非平稳时间序列分析107 5.4.5 R语言主要时序模式算法函数114 5.5 离群点检测116 5.5.1 离群点检测方法117 5.5.2 基于模型的离群点检测方法118 5.5.3 基于聚类的离群点检测方法120 5.6 小结122 实 战 篇 第6章 电力窃漏电用户自动识别126 6.1 背景与挖掘目标126 6.2 分析方法与过程129 6.2.1 数据抽取130 6.2.2 数据探索分析130 6.2.3 数据预处理133 6.2.4 构建专家样本137 6.2.5 模型构建138 6.3 上机实验143 6.4 拓展思考144 6.5 小结144 第7章 航空公司客户价值分析145 7.1 背景与挖掘目标145 7.2 分析方法与过程146 7.2.1 数据抽取149 7.2.2 数据探索分析149 7.2.3 数据预处理150 7.2.4 模型构建153 7.3 上机实验158 7.4 拓展思考159 7.5 小结159 第8章 中医证型关联规则挖掘160 8.1 背景与挖掘目标160 8.2 分析方法与过程162 8.2.1 数据获取163 8.2.2 数据预处理165 8.2.3 模型构建169 8.3 上机实验171 8.4 拓展思考172 8.5 小结172 第9章 基于水色图像的水质评价173 9.1 背景与挖掘目标173 9.2 分析方法与过程174 9.2.1 数据预处理175 9.2.2 模型构建177 9.2.3 水质评价179 9.3 上机实验180 9.4 拓展思考180 9.5 小结181 第10章 家用电器用户行为分析与事件识别182 10.1 背景与挖掘目标182 10.2 分析方法与过程183 10.2.1 数据抽取184 10.2.2 数据探索分析185 10.2.3 数据预处理185 10.2.4 模型构建195 10.2.5 模型检验198 10.3 上机实验200 10.4 拓展思考201 10.5 小结202 第11章 应用系统负载分析与磁盘容量预测203 11.1 背景与挖掘目标203 11.2 分析方法与过程205 11.2.1 数据抽取206 11.2.2 数据探索分析206 11.2.3 数据预处理207 11.2.4 模型构建208 11.3 上机实验213 11.4 拓展思考214 11.5 小结215 第12章 电子商务智能推荐服务216 12.1 背景与挖掘目标216 12.2 分析方法与过程222 12.2.1 数据抽取224 12.2.2 数据探索分析225 12.2.3 数据预处理230 12.2.4 模型构建235 12.3 上机实验245 12.4 拓展思考246 12.5 小结251 第13章 基于数据挖掘技术的市财政收入分析预测模型252 13.1 背景与挖掘目标252 13.2 分析方法与过程254 13.2.1 灰色预测与神经网络的组合模型255 13.2.2 数据探索分析256 13.2.3 模型构建259 13.3 上机实验273 13.4 拓展思考273 13.5 小结274 第14章 基于基站定位数据的商圈分析275 14.1 背景与挖掘目标275 14.2 分析方法与过程277 14.2.1 数据抽取277 14.2.2 数据探索分析278 14.2.3 数据预处理279 14.2.4 模型构建282 14.3 上机实验286 14.4 拓展思考286 14.5 小结287 第15章 电商产品评论数据情感分析288 15.1 背景与挖掘目标288 15.2 分析方法与过程288 15.2.1 评论数据采集289 15.2.2 评论预处理292 15.2.3 文本评论分词297 15.2.4 模型构建298 15.3 上机实验312 15.4 拓展思考313 15.5 小结314 提 高 篇 第16章 基于R语言的数据挖掘二次开发316 16.1 混合编程应用体验——TipDM数据挖掘平台316 16.2 二次开发过程环境配置320 16.3 R语言数据挖掘二次开发实例322 16.4 小结325 参考资料326
1、下载并解压,得出pdf文件
2、如果打不开本文件,请务必下载pdf阅读器
3、安装后,在打开解压得出的pdf文件
4、双击进行阅读
精品推荐
同类热门
类似软件
热门标签
网友评论1人参与,1条评论
最新排行
突破就是买点pdf扫描版14.99M官方版 突破就是买点是由地震出版社的燕青先生通过阅读近些年国内出版的几乎所有的1000多本股票技术分析类书籍,吸收各色高手的投资精华,历经实战,总结出自己的炒股理念的一本金融证券图书。该书以买入为先,主动进攻为先,图形依据为先等核心操作理念,向读者讲解了如
查看响应式web设计html5和css3实战第2版10.6Mpdf扫描版 响应式web设计是一种统一的解决方案,可以让web作品适配手机,平板和桌面电脑。但如何才能更好的学习和入门呢?响应式web设计html5和css3实战第2版将为用户提供最全面的讲解,是一本html和css3的实战手册,由英国程序员本·弗莱恩编著。
查看像计算机科学家一样思考python 第2版48.16M艾伦·B.唐尼pdf扫描版 像计算机科学家一样思考python 第2版是一本python语言入门书籍,由艾伦·B.唐尼编著。本书从基本的编程概念开始,一步步引导读者了解Python语言,再逐渐掌握函数、递归、数据结构和面向对象设计等高阶概念。本书第2版及其辅助代码均已升级,支
查看Oracle管理之道126.91M张天慧pdf扫描版 Oracle管理之道是目前最完整、最真实、最灵活的oracle数据库指南,由华硕集团昌硕科技DBA张天慧编著。本书内容为作者多年的DBA实践经验的提炼,完全涵盖了担任企业级数据库管理职务所应具备的知识与技能,全书从Oracle实例开始,介绍了各种内
查看c++ primer 第四版 pdf3.8M电子版c++ primer 第四版是一款完全免费的c++入门教程,本书通过一系列的示例教程,详细介绍了c++基本语言,各种容器和算法,以及C语言的高级主题应用等等,旨在为广大语言爱好者提供一个人人都能读懂的教程,以此提高程序员的编程效率。全书主要介绍了 C++
查看21天学通python电子版43.51M刘凌霞pdf扫描版 21天学通Python是一本极具影响力原创计算机编程系列图书,由刘凌霞,郝宁波和吴海涛三人共同编著,本书为了让读者更快地上手,特别设计了适合初学者的学习方式,用准确的语言总结概念、用直观的图示演示过程、用详细的注释解释代码、用形象的比方帮助记忆。全
查看python爬虫开发与项目实战91.37M范传辉pdf扫描版 python爬虫开发与项目实战是一本Python爬虫开发实战手册,由范传辉编著。本书从Python和Web前端基础开始讲起,由浅入深,包含大量案例,实用性极强。全书共有9个爬虫项目,以系统的实战项目为驱动,由浅及深地讲解爬虫开发中所需的知识和技能。
查看李炎恢bootstrap笔记3.18Mpdf版 Bootstrap是目前最为流行的一个基于html、css、javascript的前端开发框架,由两位工程师设计推出。为了让网友更好的学习,小编这里提供李炎恢bootstrap笔记下载,亦称之为李炎恢bootstrap讲义,pdf格式,详细的介绍了
查看牛奶可乐经济学pdf19.48M 牛奶可乐经济学是中国人民大学出版社出版的一款关于经济学的图书,该书介绍了许多关于经济理财方面的例子,能够让读者快速的学习掌握到各种关于经济方面的知识,此次小编给大家带来的是牛奶可乐经济学pdf版的,有需要的可以下载看看。
查看汇编语言的编程艺术第2版pdf187.05M高清电子书汇编语言的编程艺术第2版是目前讲解汇编语言最经典的图书,作者海德(Randall Hyde),马跃,包战翻译,它详细的介绍了编辑、编译和运行HLA程序,声明和使用常量、标量变量、指针、数组、结构、联合和命名空间,转换算术表达式,转换高级控制结构等内容。同
查看
第1楼 山西省长治市移动 网友