一文搞懂“预测模型”:建模思路、模型分类、应用场景
moboyou 2025-05-06 13:28 10 浏览
在数据分析领域,预测模型扮演着至关重要的角色。本文旨在为读者提供一份简明扼要的指南,从建模的基本思路到模型的分类,再到具体的应用场景,全方位解读预测模型的构建与运用。通过这篇文章,无论是数据新手还是有经验的分析师,都能获得宝贵的洞见,提升数据分析的准确性和效率。
“建个模型预测一下!”一听到要建模预测,很多同学都会菊花一紧。可以用来做预测模型很多,但是往往领导们喊着“建个模型”的时候,他丢给你的就孤零零的一行数,形如下图:
这咋办呀!你可能很想说:“就几个数,咱拍脑袋吧!”,这时候还会被领导批评。那死马当活马医的话,该咋整呢?
一、建模思路
建预测模型有两个基本思路:因果关系/时间序列
1、基于因果关系建模。比如预测一个用户是否消费,会把该用户性别、年龄、过往消费记录、喜欢什么商品、浏览过哪些网页等可能影响消费的因素视为X,将消费结果视为Y,之后利用数据计算出X与Y的公式。
2、基于时间序列建模。它把待预测的指标(销售额、用户数、出货量等)视为Y,把时间视为X,把待预测指标随着时间发展而变化的公式计算出来(形如y=ax+b,不过具体形式会更复杂)。
直观地看,两种思路需要的数据格式如下:
显然,在仅有一行数据的情况下,因果关系预测很难实现。并且一般这种只丢一行数据让预测的公司,一般数据基建也很稀烂,最多给个业绩=订单数*客单价,很少记录影响用户购买的原因。综上,在只有一列数的情况下,用时间序列法比较省事。
二、建模准备
时间序列法有3种基础形态(如下图所示):
根据不同的形态,可以选择不同的方法。因此在建模的时候,要先观察数据形态。比如开头的例子,显然同时有季节性+趋势性(如下图所示),因此可以用带趋势的季节回归来做。
三、建模过程
第一步:分别把代表趋势的自变量(t),代表季节的自变量Q1、Q2、Q3构造出来(如下图)因变量(Y)就是销售额。
第二步:利用回归模型,计算相关参数,这里直接用Excel的回归分析功能做。
第三步:观察结果,写出预测模型的公式。
第四步:代入下一年度的参数,得出预测数值。
这样就做完啦!如果领导想看,可以从回归分析的源头讲起,R平方的计算公式,参数估计原理,F检验与t检验。非数据出身的领导们一听这么多专业名词,对模型的幻想得到了一定程度的满足,也就能交差了。
四、模型扩展
Excel的回归分析默认是线性回归。但有可能X与Y之间不是线性关系,比如公司业务在高速增长阶段,随着时间发展,业绩越来越好,此时可能是多项式 or 对数关系。
因此在建模以前,可以先做散点图,检查下数据之间的关系。有趣的是,excel在添加趋势线的时候,可以直接选择拟合曲线,因此想偷懒的同学,完全可以直接如下图操作。
不过要注意的是:R平方并不是唯一判断标准,在拟合完走势后,还得关注:
1、是否拟合走势与原数据走势明显不相符
2、是否拟合走势某些点不合业务逻辑
3、是否拟合走势近期误差过大
要先做排除法,剔除这些明显有问题的。
如果剔除过后,依然有多个模型符合条件,可以计算每个模型拟合数据 VS 实际数据的均方差(MSE:Mean Squared Error),选一个均方差较小的模型来用。
当然,时间序列法还有平滑法以及平滑法的各种变体(holter & winter模型),还有ARIMA、LSTM等模型可用,等以后有机会再一一介绍。
小结
本质上看,时间序列法就是模拟过去的走势,然后按过去的走势推演。这种做法和我们用肉眼观察数据走势,拍脑袋拍个数值没有思路上的区别,仅仅是用公式替代了肉眼观察,增加了精确度而已。
不过,话说回来,做预测,本身就是“长袖善舞,多钱善贾”,数据越丰富,预测准确可能性越大。数据贫瘠,那也只能这样将就下。
而且,如果真出现黑天鹅事件,那啥方法也预测不准呀。如果是压根没数据的,比如一款过去从未做过的产品,那压根就不能做预测,而是得做测试。这就需要用到统计学假设检验方法。
本文由人人都是产品经理作者【接地气的陈老师】,微信公众号:【接地气的陈老师】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。
题图来自Unsplash,基于 CC0 协议。
相关推荐
- 声学EI要完稿?十步速写法
-
【推荐会议】国际声学与振动会议(ICAV)会议号:CFP23112A截稿时间:2025年4月20日召开时间/地点:2025年8月15-17日·新加坡论文集上线:会后3个月提交EiComp...
- 结构力学!EI会议图表规范秘籍
-
推荐会议:国际结构与材料工程进展大会(ISME2026)会议编号:EI#73521截稿时间:2026年3月10日召开时间/地点:2026年8月15-17日·德国柏林论文集上线:会后4...
- 傅里叶级数物理意义的直观理解:利用傅里叶级数逼近方波信号
-
上篇文章将向大家介绍频谱的概念,对傅里叶级数、傅里叶积分、傅里叶变换进行了数学的推导,并解释了它们各自的物理意义。推导过程见我的上一篇文章:频谱分析——频谱概念(傅里叶变换、级数、积分及物理意义)如下...
- 通过对航空发动机整机振动进行分析,有何控制方法?
-
前言针对航空发动机整机振动问题的复杂性和多样性,以整机振动的振源分析为出发点,总结国内外关于转子系统故障、气流激振、轴承故障、齿轮故障和结构局部共振等引起的整机振动的研究情况。结合航空发动机整机结构动...
- MATLIB中使用PCA
-
主成分分析PCA(PrincipalComponentsAnalysis),奇异值分解SVD(Singularvaluedecomposition)是两种常用的降维方法降维致力于解决三类问题:降维...
- 数据处理|软件:让科研更简单2
-
书接上回,继续介绍免费的数据处理软件。eGPS一款热图绘制专用软件,热图就是用颜色代表数字,让数据呈现更直观,对比更明显。优点:小巧方便,基本功能齐全,包括数据转换、聚类分析、颜色调整等等缺点:常见的...
- 电力系统常用的通讯协议及其在Speedgoat系统中的实现
-
在电力系统中,IEC61850协议、DNP3协议、ModbusTCP广泛应用于远程终端设备(RTU)、智能电子设备(IED)交互以及监控和数据采集(SCADA)系统。一、IEC61850协议IE...
- 电子工程师的常用仿真软件
-
不知道从事电子行业的工程师,有没有使用模拟仿真工具,仿真软件网上又有很多,初学者,可能只知道Multisim和Proteus。一般Multisim适合在学习模拟电路和电路分析原理课程时使用,便于理解电...
- 技术论文|异结构混沌系统的组合同步控制及电路实现
-
欢迎引用[1]李贤丽,马赛,樊争先,王壮,马文峥,于婷婷.异结构混沌系统的组合同步控制及电路实现[J].自动化与仪器仪表,2022,No.276(10):80-84.DOI:10.14016/j.cn...
- 现场︱某110KV主变事故过程仿真分析
-
三峡电力职业学院、河南省电力公司洛阳供电公司的研究人员李莉、任幼逢、徐金雄、王磊,在2016年第6期《电气技术》杂志上撰文,针对某110KV变电站主变差动保护跳闸事故,结合事故相关检测数据,通过MAT...
- 光伏发电系统篇:单级式并网系统实时仿真
-
在全球积极推动清洁能源转型的大背景下,光伏发电作为重要的可再生能源利用方式,得到了广泛关注和迅猛发展。目前常用的光伏并网及光伏电站主要拓扑结构有单级式和双级式。相较于传统的多级式系统,单级式光伏发电并...
- 光伏发电系统篇:三电平并网逆变器实时仿真
-
一、三电平并网逆变器在能源转型加速的当下,分布式能源接入电网需求大增。三电平并网逆变器凭借低谐波、高功率密度等优势,有效提升电能转换效率,于新能源并网发电中担当关键角色。常见的三电平电路拓扑结构包括二...
- 自制3.5KW大功率逆变器,很简单,看过这个电路原理就懂了
-
前言拿下8000元奖金的项目,是什么水平?本项目经过联合湖南科技大学光伏逆变以及电力电子研究生团队共同探讨方案。项目成本:1200元,获得奖金:8000元!参加赛事:立创开源硬件平台_星火计划·外包赛...
- 圈内分享:电容式加速度计接口电路非线性建模与仿真设计
-
摘要:非线性是Sigma-Delta(ΣΔ)加速度计系统的关键指标之一。基于一个五阶ΣΔ加速度计结构,分析了其主要的非线性模块,在MATLAB中建立了整体结构的行为级模型,并利用根轨迹法进行了稳...
- 基于Matlab/Simulink建立一种Thevenin/RC电池模块仿真模型
-
本文以锂电池数学模型为基础,在Matlab/Simulink的仿真系统中,建立了一种Thevenin/RC电池模块仿真模型,通过实际工况试验,测试精度在允许误差范围内,为电池SOC/SOH研究提供了极...
- 一周热门
- 最近发表
- 标签列表
-
- curseforge官网网址 (16)
- 外键约束 oracle (36)
- oracle的row number (32)
- 唯一索引 oracle (34)
- oracle in 表变量 (28)
- oracle导出dmp导出 (28)
- oracle 数据导出导入 (16)
- oracle两个表 (20)
- oracle 数据库 使用 (12)
- 启动oracle的监听服务 (13)
- oracle 数据库 字符集 (20)
- powerdesigner oracle (13)
- oracle修改端口 (15)
- 左连接 oracle (15)
- oracle 标准版 (13)
- oracle 转义字符 (14)
- asp 连接 oracle (12)
- oracle安装补丁 (19)
- matlab三维图 (12)
- matlab归一化 (16)
- matlab求解方程 (13)
- matlab坐标轴刻度设置 (12)
- matlab脚本 (14)
- matlab多项式拟合 (13)
- matlab阶跃函数 (14)