python回归模型_python自回归模型是什么?

如今是互联网高速发展新时期,需要高科技的产品应用到人们的生活中去,但是很多高科技产品都离不开编程的开发。就好比最近人们常常提起的python自回归模型。那么可能有人就要问了,python自回归模型是什么?打个比方,在python自回归模型中,我们经常可以用现在产品的价格,可以粗略的推算出明天产品的价格,这就是我们要讨论的在自回归模型中对python产品的预测。

c979fcc1-c7cd-42a2-8459-f519f66d6106.jpg

python自回归模型是什么?

自回归模型或简称为AR模型,仅依靠过去的时间值来预测当前值。这是一个线性模型,其中当前期间的值是过去结果的总和乘以数字因子。我们将其表示为AR(p),其中“

p”称为模型的阶数,表示我们要包括的滞后值的数量。

例如,如果我们将X作为时间序列变量,则AR(1)(也称为简单自回归模型)将看起来像这样:

X t = C + ϕ 1 X t-1 + ϵ t

让我们仔细研究这个等式的不同部分,以确保我们很好地理解这个概念。

X t-1是多少?

对于初学者,X t-1表示上一期间的X值。

让我们详细说明。

如果“ t”代表今天并且我们有每周值,那么“ t-1”代表上周。因此,X t-1描述了一周前记录的值。

ϕ 1是什么?

系数ϕ 1是一个数字常数,通过该常数我们可以将滞后变量(X

t-1)相乘。您可以将其解释为先前值的一部分,该值会保留在将来。值得注意的是,这些系数应始终在-1和1之间。

让我解释一下原因。

如果系数的绝对值大于1,则随着时间的流逝,它将无可估量地爆炸。

起初,这个想法似乎令人困惑。因此,让我们看一个数学示例。

假设我们有一个包含1000个观测值的时间序列,ϕ 1 = 1.3并且C = 0。

然后,X 2 = 0 + 1.3 X 1

既然X 3 = 1.3 X 2,我们可以用(1.3 X 1)代替X 2,得到X 3 = 1.3(1.3 X 1)= 1.3 2 X

1。然后,随着累积的时间越多(例如X 50),系数增加的幅度就越大(1.3 49 X 1)。

当我们到达第1000个周期时,我们将得到X 1000 = 1.3 999 X

1。这意味着这些值会继续增加,最终比初始值要高得多。这显然不是预测未来的可靠方法。

什么是ε 牛逼?

好了,现在我们需要打破方程的唯一部分是ε 牛逼。这就是所谓的残留,并代表周期t和正确的值(ε我们的预测之间的差吨 = Y 吨 - ŷ

吨)。这些残差通常是不可预测的差异,因为如果存在某种模式,它将被模型的其他现有因素捕获。

我们如何解释自回归模型?

现在我们知道模型的所有部分代表什么,让我们尝试对其进行解释。根据等式,在给定时期(X值吨)等于某个部分(φ 1中的最后一个时间段(X值)T-1),加上一些恒定基准的和不可预测的冲击ε 吨。

了解我们在给定的数据集上不仅仅使用任何自回归模型至关重要。我们首先需要确定要在分析中包括多少个滞后(过去值)。

具有更多滞后的自回归模型

例如,有关气象条件的时间序列将不仅仅依赖于一天前的天气统计数据。可以肯定地说,它将使用过去7天的数据。因此,该模型应考虑最多7个周期的值。

从数学的角度来看,使用两个滞后的模型(AR(2))如下所示:

X t = C + ϕ 1 X t-1 + ϕ 2 X t-2 + ϵ t

如您所料,更复杂的自回归模型将包含更多滞后值X t-n以及它们相关的系数ϕ n。

我们包含的滞后越多,我们的模型就越复杂。

模型越复杂,我们必须确定的系数就越多,结果,其中某些系数不重要的可能性就越大。

现在,通常来说,考虑到更多数据进行预测的模型通常会更好。但是,如果系数(ϕ 1,ϕ 2,…… n)与0的差别不大,则它们对预测值没有影响(因为ϕ k

X t-k = 0),因此将它们包括在内几乎没有意义。在模型中。

当然,无法手动确定这些系数的重要性。

对我们来说幸运的是,Python非常适合这项工作。借助方便的库(例如Pandas和Statsmodels),我们可以为任何给定的数据集确定最合适的自回归模型。

如果您想了解有关在Python中实现自回归模型或模型选择过程如何工作的更多信息,请务必查看我们的分步Python教程。

如果您不熟悉 Python,并且热衷于了解更多信息,那么这篇有关学习Python编程的综合文章将指导您从安装到Python

IDE,库和框架,再到最佳Python职业发展道路,以及工作前景。

以上就是关于python自回归模型是什么的全部内容,如果想了解更多关于python的信息,请继续关注中培教育。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
数据来源:中经数据库 主要指标110多个(全部都是纯粹的 市辖区 指标),大致是: GDP GDP增速 第一产业增加值占GDP比重 第二产业增加值占GDP比重 第三产业增加值占GDP比重 人均GDP 社会消费品零售总额 固定资产投资(不含农户) 新设外商投资企业数_外商直接投资 实际利用外资金额(美元) 一般公共预算收入 一般公共预算支出 一般公共预算支出_教育 一般公共预算支出_科学技术 金融机构人民币各项存款余额_个人储蓄存款 金融机构人民币各项存款余额 金融机构人民币各项贷款余额 规模以上工业企业单位数 规模以上工业企业单位数_内资企业 规模以上工业企业单位数_港澳台商投资企业 规模以上工业企业单位数_外商投资企业 规模以上工业总产值 规模以上工业总产值_内资企业 规模以上工业总产值_港澳台商投资企业 规模以上工业总产值_外商投资企业 规模以上工业企业流动资产合计 规模以上工业企业固定资产合计 规模以上工业企业利润总额 规模以上工业企业应交增值税 规模以上工业企业主营业务税金及附加 户籍人口数 年均户籍人口数 户籍人口自然增长率 第一产业就业人员占全部城镇单位就业人员比重 第二产业就业人员占全部城镇单位就业人员比重 第三产业就业人员占全部城镇单位就业人员比重 城镇非私营单位就业人员数 城镇非私营单位就业人员数_第一产业 城镇非私营单位就业人员数_第二产业 城镇非私营单位就业人员数_第三产业 城镇非私营单位就业人员数_农、林、牧、渔业 城镇非私营单位就业人员数_采矿业 城镇非私营单位就业人员数_制造业 城镇非私营单位就业人员数_电力、热力、燃气及水生产和供应业 城镇非私营单位就业人员数_建筑业 城镇非私营单位就业人员数_批发和零售业 城镇非私营单位就业人员数_交通运输、仓储和邮政业 城镇非私营单位就业人员数_住宿和餐饮业 城镇非私营单位就业人员数_信息传输、软件和信息技术服务业 城镇非私营单位就业人员数_金融业 城镇非私营单位就业人员数_房地产业 城镇非私营单位就业人员数_租赁和商务服务业 城镇非私营单位就业人员数_科学研究和技术服务业 城镇非私营单位就业人员数_水利、环境和公共设施管理业 城镇非私营单位就业人员数_居民服务、修理和其他服务业 城镇非私营单位就业人员数_教育 城镇非私营单位就业人员数_卫生和社会工作 城镇非私营单位就业人员数_文化、体育和娱乐业 城镇非私营单位就业人员数_公共管理、社会保障和社会组织 城镇非私营单位在岗职工平均人数 城镇就业人员数_私营企业和个体 城镇非私营单位在岗职工工资总额 城镇非私营单位在岗职工平均工资 城镇登记失业人员数 建成区面积 建设用地面积 建设用地面积_居住用地 液化石油气供气总量 液化石油气供气总量_居民家庭 人工煤气、天然气供气总量 人工煤气、天然气供气总量_居民家庭 液化石油气用气人口 人工煤气、天然气用气人口 城市公共汽电车运营车辆数 城市出租汽车运营车辆数 城市公共汽电车客运总量 道路面积 排水管道长度 建成区绿化覆盖面积 建成区绿化覆盖率 绿地面积 公园绿地面积 维护建设资金支出 土地面积 生活用水供水量 供水总量 全社会用电量 城乡居民生活用电量 工业生产用电量 房地产开发投资 房地产开发投资_住宅 限额以上批发和零售业法人单位数 限额以上批发和零售业商品销售总额 普通中学学校数 中等职业教育学校数 普通小学学校数 普通高等学校专任教师数 普通中学专任教师数 中等职业教育专任教师数 普通小学专任教师数 普通高等学校在校生数 普通中学在校生数 中等职业教育在校生数 普通小学在校生数 电视节目综合人口覆盖率 公共图书馆总藏量_图书 医疗卫生机构数_医院和卫生院 卫生人员数_执业(助理)医师 医疗卫生机构床位数_医院和卫生院 城镇职工基本养老保险参保人数 职工基本医疗保险参保人数 失业保险参保人数

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值