郑州大数据分析、数据挖掘、R语言处理培训班

  • 营业执照
  • 办学资质
  • 售后服务
+收藏

求学价: ¥5800 发布用户:zpeduzbo

发布时间:2019-05-08 已有20人浏览报名

课程介绍

 

大数据分析及可视化应用实战培训班

2019年公开课安排:

珠海:3月29日-4月01日

上海:5月24日-5月27日

烟台:7月26日-7月29日

郑州:9月20日-9月23日

贵阳:11月15-11月18日

培训讲师:游老师 谢老师 赵老师 张老师

培训收费:面授班培训费5800 元/人

培训证书:中国信息化培训中心颁发《大数据分析与可视化技术应用高级工程师》证书

课程大纲:(理论+项目实战,每天6-7课时)

第1天上午 数据分析基础及实战

第1讲  R语言基础

Ø讲解R语言背景、国内发展状况、基础语法、数据结构及绘图操作等内容。特别针对向量计算这块,着重介绍R语言在这方面的优势及用法。

第二讲  统计分析基础

Ø讲解统计分析基础,包括统计学基本概念,假设检验,置信区间等基础,并结合数据案例说明其使用场景和运用方法。介绍数据分析流程和常见分析思路,并结合R语言案例进行讲解。

第三讲  R语言数据处理基础

Ø从数据接入、数据统计、数据转换等几个方面进行讲解。数据接入包含接入mysql、oracle、hadoop等常见数据库操作;数据统计包含dplyr包、data.table等包的具体用法和讲解;数据转换包含R语言常用的apply族、reshape包、tidyr等包的具体用法和案例讲解。

 

第1天下午 数据挖掘理论及核心技术

第四讲 数据挖掘基础

Ø讲解数据挖掘基本概念,细致讲解业务理解、数据理解、数据准备、建立模型、模型评估、模型部署各环节的工作内容及相关技术;结合业界经典场景,讲解数据挖掘的实施流程和方法体系。

第五讲 数据挖掘核心技术

Ø细致讲解抽样、分区、样本平衡、特征选择、训练模型、评估模型等数据挖掘核心技术原理,并结合案例讲解其具体实现和用法。尤其针对样本平衡,重点讲解人工合成、代价敏感等算法;针对特征选择,重点讲解特征选择的核心思路,并结合常见的R语言包进行案例演示。

第六讲 R语言数据挖掘工具

Ø讲解Rattle数据挖掘工具的用法,包括各项功能的具体使用;讲解Microsoft R Server工具的具体用法和操作。

第二天上午 数据挖掘算法原理及实现

第七讲 特征降维算法及R语言实现

Ø讲解主成分及因子分析原理,并结合案例进行R语言实现。

第八讲 关联规则算法及R语言实现

Ø讲解Apriori关联规则算法原理,并结合案例进行R语言实现。

第九讲 决策树算法及R语言实现

Ø讲解ID3、C4.5、C5.0以及CART决策树算法的实现原理,并结合案例进行R语言实现。

第十讲 聚类算法及R语言实现

Ø讲解kmeans、系统聚类算法原理,并结合R语言进行案例讲解。

 

第二天下午 数据挖掘建模实战

第十一讲 基于乳腺癌数据进行降维分析并建立分类模型

Ø实战部分:基于乳腺癌数据进行降维处理,并尝试建立分类评估模型。旨在通过该模型,并潜在的乳腺癌患者进行识别。

第十二讲 基于在线零售数据建立关联规则模型

Ø实战部分:基于在线零售数据,经过一定的处理,对该数据进行关联规则建模,旨在从此数据中挖掘出潜在的规则,对业务运营进行指导决策。

第十三讲 Lending Club信贷违约分析案例

Ø实战部分:基于Lending Club信贷违约数据,尝试从多个不同的维度进行数据分析,旨在发现一些有价值的信息,同时基于该数据,经过一定的处理,建立信贷违约识别模型,旨在对信贷业务办理提供模型支持,降低违约风险。

第十四讲 航空公司客户分群案例

Ø实战部分:基于航空公司的业务诉求,结合历史乘客数据,建立客户分群模型,旨在对客户进行差异化营销活动,提高客户粘性和价值转化。

 

第三天上午 R语言应用实战(一)

第十五讲 R语言与自然语言处理原理及案例

Ø讲解自然语言处理基本概念和技法,包含分词、关键字提取、文摘提取、文本分类、主题模型、word2vec等内容。并使用R语言进行案例讲解。

第十六讲 R语言网络爬虫及案例

Ø讲解爬虫实现的基本原理,并介绍XML包、rvest包、jsonlite、RSelenium的使用,同时结合真实案例进行演示。

第十七讲 社交关系图分析及R语言案例

Ø讲解社交关系图分析的基本原理和使用场景,介绍R语言igraph、d3Network、visNetwork包的用法,此外,介绍neo4j数据库,并结合RNeo4j包进行讲解,通过具体的案例,讲解社交关系图的构建和具体实现过程。

 

第三天下午 R语言应用实战(二)

第十八讲 数据分析图表及R语言案例

Ø讲解常用的数据分析图表及其使用场景,同时结合R语言lattice包、ggplot2、recharts等包进行案例讲解。

第十九讲 使用R Markdown编写数据分析报告

Ø讲解使用R Markdown编写数据分析报告的具体方法,并结合案例讲解其用法。

第二十讲 R语言shiny可视化开发实战

Ø介绍R语言shiny的UI、Server、Reactivity、控件等内容,同时讲解一个用shiny实现数据分析功能(兼图表)的实际案例,搭建服务器,在企业内部实现轻量级数据分析应用。

第四天 学习考核与业内经验交流


标签:

郑州大数据分析培训烟台r语言处理培训

显示全部

学校介绍

中培教育

认证机构

黄金会员5年

查看信用档案

学校人气度:14621

中国信息化培训中心(简称中培)致力于为我国提供较高端的IT咨询与培训服务。公司成立十年来一直秉持“顾客满意度第几、利润第二”的理念,努力达到中国IT咨询与培训服务的第几品牌。中培伟业当前主要服务范畴涵盖IT管理与IT技术两大范畴。

中培是由北京中培伟业管理咨询有限公司发展壮大而来,目前中培拥有国内较知名的技术、管理专家组成的讲师和咨询顾问团队,同时拥有一批国内外知名企业的高层经理和资深专家。中国信息化培训中心提供的所有培训课程均由具有丰富教学和实战经验的业内名师开发,既保证了课程知识体系架构的完整性,又能确保课程与企业实际紧密结合,极具可操作性和实用价值。

中培伟业严格按照ISO9001国际质量管理体系标准及咨询服务业标准规范,建立标准化的服务流程,对我们的培训、咨询服务实施全过程质量控制,与顾客充分沟通,关注顾客反馈,保证客户需求的完美实现。

中培以推进中国信息化发展为使命,客户的良好评价是对我们较好的褒奖。专业的技术、先进的理念、规范的管理,是我们为企业服务的有力保障。

课程规模:每年超过100场不同的公开课程;每年企业内训至少120次以上。

第四季度公开课.png



进入学校主页

相关课程

加载更多

热门推荐

新闻资讯

加载更多

QQ咨询

微信咨询