揭秘 | Excel和PBI的思维 | 告别开始难的问题,祝大家都能成为数据大神实现升职加薪!
- 2026-09-27 03:43:53

一、课程大纲

理论部分:数据的逻辑和思维
实操部分:通过Excel的Power Query进行数据导入和合并,解决多源数据整合效率问题。

二、数据分析的逻辑和思维
1. 数据分析的价值

应用场景:从互联网平台(如小红书、抖音)的个性化推荐,到金融投资和财务模型的数据分析
核心价值:通过分析用户兴趣标签(如APP偏好、LBS行为数据等)实现精准营销
数据规范重要性:构建模型时70%时间用于数据清洗和规范化处理
2. 数据分析三种核心思维
1)结构化思维

定义:将凌乱问题分解为层级清晰的逻辑框架(类似组织架构图)
实施步骤:
确定核心问题(如"8月销售额下降20%")
分层展开(地域影响→竞品分析→用户访谈)
使用工具:XMind/百度脑图制作思维导图
典型案例:
内部因素:消费者分层(新客/老客)、地区ABC销售数据
外部因素:竞品分析(a/b/c)、政策风险(如口罩需求波动)
常见误区:零散分析(想到一点是一点)、缺乏系统框架
2)公式化思维

核心原则:所有业务指标均可量化表达
基础公式:
销售额=销量×客单价销售额=销量×客单价销售额 = 销量 × 客单价
扩展公式:
地区销量=
∑渠道销量∑渠道销量∑ 渠道销量 客单价=
原价×折扣率原价×折扣率原价 × 折扣率
创新应用:
用户获取模型:
主动流量=
曝光量×转化率曝光量×转化率曝光量 × 转化率 被动流量=
邀请人数×人均邀请量×转化率邀请人数×人均邀请量×转化率邀请人数 × 人均邀请量 × 转化率 可自定义公式(如为北京客户创建的消费分析公式
与结构化结合:将思维导图节点转化为可计算的数学关系
3)业务化思维

本质:将理论模型与实际业务场景深度结合
实施要点:
行业特性认知(如金融vs零售的数据差异)
业务指标设计(如共享单车需考虑损耗率)
原因深度挖掘(销售下滑需区分表象与根本原因)
典型案例:
销售公司分析:需结合员工士气、产品质量、定价策略等业务细节
数据落地标准:模型结果必须可执行(如优化渠道投放)

三阶段演进:结构化思维→结构化数据→结构化业务数据
注:所有时间戳均对应课程视频中的关键节点,图片路径保持原始命名规范。案例部分保留了教师讲解中的所有具体企业名称和业务场景,确保知识点的真实性和可操作性。
三、数据分析软件和对比
1.Power BI和组件介绍

核心组件:由Power Query(数据获取)、Power Pivot(建模分析)、Power View(交互报表)三大模块组成,与Excel功能对应但更强大
版本差异:商业版支持团队协作和高级功能(每月数百至数千美元),单机免费版已包含完整分析功能
行业定位:微软开发的商业智能工具,特别适合需要数据建模和可视化仪表板的企业场景
学习路径:掌握Excel的Power Query即可无缝过渡到Power BI同模块,两者操作逻辑完全一致。

本土化优势:提供行业模板库(零售、金融等),支持中文环境下的数据血缘分析和关联视图
部署要求:需安装本地服务器组件,占用5-10G存储空间,适合有固定分析需求的中型企业
操作特点:与Power BI类似的数据处理流程(准备→处理→可视化→分享),但预置更多符合国内业务场景的分析模型
2. 数据分析工具三大功能

预处理阶段:包含数据清洗(缺失值/异常值处理)、特征工程(变量生成/类型转换)、数据整合(多表关联/爬虫)等9大基础操作
关键差异点:SAS/Python擅长处理千万级数据,而Excel/SPSS在百万级以下数据效率更高
可视化分类:
趋势类:适用于时间序列分析(如销售增长率)
对比类:用于AB测试结果呈现(如渠道转化率对比)
构成类:展示市场份额等结构数据
分布类:揭示数据密度或地理分布特

商业常用模型:
分类模型:逻辑回归(金融风控)、决策树(客户分群)
预测模型:线性回归(销售预测)、指数平滑(库存预警)
关联模型:Apriori算法(购物篮分析)
实施建议:Power BI/帆软已内置基础建模模块,非专业团队可直接调用预制算法
3. Excel工具常用模块

数据处理三板斧:
数据透视表:支持百万行数据聚合分析(需配合Power Query)
条件格式:快速识别数据异常点(如TOP10自动标红)
分列去重:规范非结构化数据(如地址信息拆分)
函数应用场景:
VLOOKUP:跨表匹配关键字段(注意第4参数必须为0)
COUNTIFS:多条件计数(比单一COUNTIF效率提升40%)
TEXT:强制格式转换(如日期转"YYYY-MM"格式)
4. SAS工具常用模块

Data步核心操作:
数据步:通过PDV(程序数据向量)实现批处理
宏编程:自动化重复操作(如按月循环生成报表)
行业壁垒:正版授权费超百万,认证工程师培训成本约20万/人
适用场景:金融反欺诈模型、医疗临床试验数据分析等专业领域
5. Python工具使用场景

核心库组合:
Pandas:处理表格数据(类似Excel但支持更大数据量)
Matplotlib:生成出版级图表(需配合Seaborn美化)
Scikit-learn:实现机器学习全流程(含模型评估)
特色应用:
网络爬虫:Scrapy框架可日抓取百万级网页
文本分析:结巴分词准确率达95%+(需自定义词典)
深度学习:TensorFlow/PyTorch支持GPU加速训练
注:所有工具选择需综合考虑数据规模(Excel≤百万行)、分析复杂度(是否需要自定义算法)、预算(商业软件vs开源方案)三大要素。
四、学习效果

能力提升:学习后可以建立数据分析模型,实现数据可视化功能
自动化优势:数据导入后能自动呈现分析结果,无需重复建模。

动态更新:在Power BI中建立模型后,数据源更新时可视化结果会自动同步变化
分析维度:可计算营收、利润、净利润率等指标,支持同比环比分析












