Python数据挖掘(专题篇)

  培训讲师:傅一航

讲师背景:
傅一航,华为系大数据专家。傅一航,男,计算机软件与理论硕士研究生(研究方向:数据挖掘、搜索引擎)。在华为工作十年,五篇国家专利,在华为工作期间获得华为数项奖项,曾在英国、日本、荷兰等国家做项目,对大数据有深入的研究。傅老师专注于大数据分析与 详细>>

傅一航
    课程咨询电话:

Python数据挖掘(专题篇)详细内容

Python数据挖掘(专题篇)

Python数据挖掘专题实战培训【课程目标】
本课程主要讲解如何利用Python进行时间序列的数据建模。
通过本课程的学习,达到如下目的:
全面掌握Python语言以及其编程思想。
掌握常用扩展库的使用,特别是数据挖掘相关库的使用。
学会使用Python完成数据挖掘项目整个过程。
掌握利用Python实现可视化呈现。
掌握数据挖掘常见算法在Python中的实现。
【授课时间】
2-5天时间
(要根据学员的实际情况调整重点内容及时间)
【授课对象】
业务支持部、IT系统部、大数据系统开发部、大数据分析中心、网络运维部等相关技术人员。
【学员要求】
每个学员自备一台便携机(必须)。
便携机中事先安装好Python 3.9版本及以上。
安装好Numpy,Pandas,statsmodels,sklearn,scipy等常用库。
注:讲师现场提供分析的数据源。
【授课方式】
语言基础 + 挖掘模型 + 案例演练 + 开发实践 + 可视化呈现
采用互动式教学,围绕业务问题,展开数据分析过程,全过程演练操作,让学员在分析、分享、讲授、总结、自我实践过程中获得能力提升。
【课程大纲】
数据挖掘基础
数据挖掘概述
数据挖掘的标准流程(CRISP-DM)
商业理解
数据准备
数据理解
模型建立
模型评估
模型应用
案例:客户流失预测及客户挽留
数据挖掘常用模型
数据预处理篇
数据预处理的主要任务
数据集成:多个数据集的合并
数据清理:异常值的处理
数据处理:数据筛选、数据精简、数据平衡
变量处理:变量变换、变量派生、变量精简
数据归约:实现降维,避免维灾难
数据集成
数据追加(添加数据)
变量合并(添加变量)
数据理解(异常数据处理)
取值范围限定
重复值处理
无效值/错误值处理
缺失值处理
离群值/极端值处理
数据质量评估
数据准备:数据处理
数据筛选:数据抽样/选择(减少样本数量)
数据精简:数据分段/离散化(减少变量的取值个数)
数据平衡:正反样本比例均衡
数据准备:变量处理
变量变换:原变量取值更新,比如标准化
变量派生:根据旧变量生成新的变量
变量精简:降维,减少变量个数
数据降维
常用降维的方法
如何确定变量个数
特征选择:选择重要变量,剔除不重要的变量
从变量本身考虑
从输入变量与目标变量的相关性考虑
对输入变量进行合并
因子分析(主成分分析)
因子分析的原理
因子个数如何选择
如何解读因子含义
案例:提取影响电信客户流失的主成分分析
数据探索性分析
常用统计指标分析
单变量:数值变量/分类变量
双变量:交叉分析/相关性分析
多变量:特征选择、因子分析
演练:描述性分析(频数、描述、探索、分类汇总)
数据可视化
数据可视化:柱状图、条形图、饼图、折线图、箱图、散点图等
图形的表达及适用场景
演练:各种图形绘制
用户专题分析
用户专题分析的主要任务
客户群细分与聚类分析
问题:我们的客户有几类?各类特征是什么?如何实现客户细分,开发符合细分市场的新产品?
聚类方法原理介绍
聚类方法作用及其适用场景
聚类分析的种类
K均值聚类
案例:移动三大品牌细分市场合适吗?
演练:宝洁公司如何选择新产品试销区域?
演练:如何评选优秀员工?
演练:中国各省份发达程度分析,让数据自动聚类
最优K值选择
Elbow手肘法
Silhouette Coefficient轮廓系数
Calinski-Harabasz Index准则
双聚类bicluster及评估
谱聚类联合
联合谱聚类SpectralCoclustering双向谱聚类SpectralBiclusteringDBSCAN邻近聚类
客户喜好评估与主成分分析PCA
营销问题:如何汇聚大众的共同喜好?
主成分分析方法介绍
主成分分析基本思想
主成分分析步骤
案例:如何评估汽车购买者的客户细分市场
客户价值评估与RFM模型
营销问题:如何评估客户的价值?不同的价值客户有何区别对待?
RFM模型(客户价值评估)
RFM模型,更深入了解你的客户价值
RFM模型与市场策略
RFM模型与活跃度分析
案例:淘宝客户价值评估与促销名单
案例:重购用户特征分析
产品专题分析
产品专题分析主要任务
产品设计分析
市场占有分析
累计销量分析
定价策略分析
产品设计优化(联合分析法)
问题:如何设计最优的功能特征?
评估功能特征的重要性
评估功能特征的价值
案例:产品开发与设计分析
产品评估模型(随机效用理论)
属性重要性评估
市场占有率评估
产品价格弹性评估
评估产品的品牌价值
动态调价(纳会均衡价格)
案例:品牌价值与价格敏感度分析
案例:纳什均衡价格
产品定价策略
营销问题:产品如何实现最优定价?套餐价格如何确定?采用哪些定价策略可达到利润最大化?
常见的定价方法
产品定价的理论依据
需求曲线与利润最大化
如何求解最优定价
案例:产品最优定价求解
如何评估需求曲线
价格弹性
曲线方程(线性、乘幂)
如何做产品组合定价
如何做产品捆绑/套餐定价
最大收益定价(演进规划求解)
避免价格反转的套餐定价
案例:电信公司的宽带、IPTV、移动电话套餐定价
非线性定价原理
要理解支付意愿曲线
支付意愿曲线与需求曲线的异同
案例:双重收费如何定价(如会费+按次计费)
阶梯定价策略
案例:电力公司如何做阶梯定价
数量折扣定价策略
案例:如何通过折扣来实现薄利多销
定价策略的评估与选择
案例:零售公司如何选择最优定价策略
航空公司的收益管理
收益管理介绍
如何确定机票预订限制
如何确定机票超售数量
如何评估模型的收益
案例:FBN航空公司如何实现收益管理(预订/超售)
产品推荐与协同过滤
问题:购买A产品的顾客还常常要购买其他什么产品?应该给客户推荐什么产品最有可能被接受?
从搜索引擎到推荐引擎
常用产品推荐模型及算法
基于流行度的推荐
基于排行榜的推荐,适用于刚注册的用户
优化思路:分群推荐
基于内容的推荐CBR
关键问题:如何计算物品的相似度
优缺点
优化:Rocchio算法、基于标签的推荐、基于兴趣度的推荐
基于用户的推荐
关键问题:如何对用户分类/计算用户的相似度
算法:按属性分类、按偏好分类、按地理位置
协同过滤的推荐
基于用户的协同过滤
基于物品的协同过滤
冷启动的问题
案例:计算用户相似度、计算物品相似度
基于分类模型的推荐
其它推荐算法
LFM基于隐语义模型
按社交关系
基于时间上下文
多推荐引擎的协同工作
信用评分卡模型
信用评分卡模型简介
评分卡的关键问题
信用评分卡建立过程
筛选重要属性
数据集转化
建立分类模型
计算属性分值
确定审批阈值
筛选重要属性
属性分段
基本概念:WOE、IV
属性重要性评估
数据集转化
连续属性最优分段
计算属性取值的WOE
建立分类模型
训练逻辑回归模型
评估模型
得到字段系数
计算属性分值
计算补偿与刻度值
计算各字段得分
生成评分卡
确定审批阈值
画K-S曲线
计算K-S值
获取最优阈值
交叉销售与关联规则
关联规则概述
常用关联规则算法
Apriori算法
发现频繁集
生成关联规则
FP-Growth算法
构建FP树
提取规则
案例:使用apriori实现关联分析
基于关联分析的推荐
如何制定套餐,实现交叉/捆绑销售
案例:啤酒与尿布、飓风与蛋挞
关联分析模型原理(Association)
关联规则的两个关键参数
支持度
置信度
关联分析的适用场景
案例:购物篮分析与产品捆绑销售/布局优化
案例:通信产品的交叉销售与产品推荐
结束:课程总结与问题答疑。

 

傅一航老师的其它课程

数据分析方法及生产运营实际应用【课程目标】本课程主要介绍数据分析在生产运营过程中的应用,适用于制造行业/保险行业的数据分析人员等。本课程的主要目的是,帮助学员了解大数据的本质,培养学员的数据意识和数据思维,掌握常用的统计分析方法和工具,以及生产、运营过程中的应用,并以概率的方式来进行决策,提升学员的数据分析及应用能力。本课程具体内容包括:数据决策逻辑,数据决

 讲师:傅一航详情


大数据建模大赛辅导实战【课程目标】本课程主要面向专业人士的大数据建模竞赛辅导需求(假定学员已经完成Python建模及优化--回归篇/分类篇的学习)。通过本课程的学习,达到如下目的:熟悉大赛常用集成模型掌握模型优化常用措施,掌握超参优化策略掌握特征工程处理,以及对模型质量的影响掌握建模工程管道类(Pipeline,ColumnTransformer)的使用【授

 讲师:傅一航详情


大数据时代的精准营销【课程目标】本课程从实际的市场营销问题出发,了解大数据在市场营销领域的价值以及应用。并对大数据分析与挖掘技术进行了介绍,通过从大量的市场营销数据中分析潜在的客户特征,挖掘客户行为特点,实现精准营销,帮助市场营销团队深入理解业务运作,支持业务策略制定以及营销决策。通过本课程的学习,达到如下目的:了解大数据营销内容,掌握大数据在营销中的应用。

 讲师:傅一航详情


大数据时代的精准营销【课程目标】本课程从实际的市场营销问题出发,了解大数据在市场营销领域的价值以及应用。并对大数据分析与挖掘技术进行了介绍,通过从大量的市场营销数据中分析潜在的客户特征,挖掘客户行为特点,实现精准营销,帮助市场营销团队深入理解业务运作,支持业务策略制定以及营销决策。通过本课程的学习,达到如下目的:了解大数据营销内容,掌握大数据在营销中的应用。

 讲师:傅一航详情


大数据决策思维与商业模式创新,赋能企业增长【课程目标】本课程主要帮助大家理解大数据的基本概念,着重探索大数据的本质,理解大数据的核心价值,以及掌握实现大数据价值的三个关键环节,大数据解决业务问题的六个步骤,然后聚焦大数据的七大核心思维,最后,再用案例说明了大数据在各行业的应用场景。大数据思维,让决策更科学!让管理更高效!让营销更精准!通过本课程的学习,达到如

 讲师:傅一航详情


大数据思维与应用创新【课程目标】本课程主要帮助大家理解大数据的基本概念,着重探索大数据的本质,理解大数据的核心价值,以及掌握实现大数据价值的三个关键环节,大数据解决业务问题的六个步骤,然后聚焦大数据的七大核心思维,最后,再用案例说明了大数据在各行业的应用场景。大数据思维,让决策更科学!让管理更高效!让营销更精准!通过本课程的学习,达到如下目的:了解大数据基本

 讲师:傅一航详情


大数据思维与应用创新【课程目标】本课程主要帮助大家理解大数据的基本概念,着重探索大数据的本质,理解大数据的核心价值,以及掌握实现大数据价值的三个关键环节,大数据解决业务问题的六个步骤,然后聚焦大数据的七大核心思维,最后,再用案例说明了大数据在各行业的应用场景。大数据思维,让决策更科学!让管理更高效!让营销更精准!通过本课程的学习,达到如下目的:了解大数据基本

 讲师:傅一航详情


大数据思维与应用创新【课程目标】本课程主要帮助大家理解大数据的基本概念,着重探索大数据的本质,理解大数据的核心价值,以及掌握实现大数据价值的三个关键环节,大数据解决业务问题的六个步骤,然后聚焦大数据的七大核心思维,最后,再用案例说明了大数据在各行业的应用场景。大数据思维,让决策更科学!让管理更高效!让营销更精准!通过本课程的学习,达到如下目的:了解大数据基本

 讲师:傅一航详情


大数据挖掘工具:SPSSStatistics入门与提高【课程目标】本课程为数据分析和挖掘的工具篇,本课程面向数据分析部等专门负责数据分析与挖掘的人士,专注大数据挖掘工具SPSSStatistics的培训。IBMSPSS工具是面向非专业人士的高级的分析工具(挖掘工具),它提供大量的分析方法和分析模型,能够解决更复杂的业务问题,比如影响因素分析、客户行为预测/精

 讲师:傅一航详情


金融行业风险预测模型实战【课程目标】本课程专注于金融行业的风控模型,面向数据分析部等专门负责数据分析与建模的人士。本课程的主要目的是,培养学员的大数据意识和大数据思维,掌握常用的数据分析方法和数据分析模型,并能够用于对客户行为作分析和预测,提升学员的数据分析综合能力。通过本课程的学习,达到如下目的:掌握数据分析和数据建模的基本过程和步骤掌握客户行为分析中常用

 讲师:傅一航详情


COPYRIGT @ 2001-2018 HTTP://WWW.QG68.CN INC. ALL RIGHTS RESERVED. 管理资源网 版权所有