您当前的位置：首页 > 电脑百科 > 程序开发 > 算法

时序分析中的常用算法，都在这里了

时间：2023-12-12 13:35:59 来源：微信公众号作者：AI超数据

+ 加入收藏

时序分析就是利用过去一段时间内某事件时间的特征来预测未来一段时间内该事件的特征。这是一类相对比较复杂的预测建模问题，和回归分析模型的预测不同，时间序列模型是依赖于事件发生的先后顺序的，同样大小的值改变顺序后输入模型产生的结果是不同的。

时序分析中的常用算法，都在这里了

时序问题都看成是回归问题，只是回归的方式（线性回归、树模型、深度学习等）有一定的区别。

时序分析包括静态时序分析（STA）和动态时序分析。

以下为几种常见的时序分析算法

1 深度学习时序分析

RNN(循环神经网络)

循环神经网络是指一个随着时间的推移，重复发生的结构。在自然语言处理（NLP），语音图像等多个领域均有非常广泛的应用。RNN网络和其他网络最大的不同就在于RNN能够实现某种“记忆功能”，是进行时间序列分析时最好的选择。如同人类能够凭借自己过往的记忆更好地认识这个世界一样。RNN也实现了类似于人脑的这一机制，对所处理过的信息留存有一定的记忆，而不像其他类型的神经网络并不能对处理过的信息留存记忆。

优点：

具有时间记忆功能，适用于解决时间序列中间隔较短的问题；

缺点：

对较远时间步的数据易产生梯度消失、梯度爆炸的问题；

LSTM(长短时记忆网络)

长短时记忆网络（LSTM，Long Short-Term Memory）是一种时间循环神经网络，是为了解决一般的RNN（循环神经网络）存在的长期依赖问题而专门设计出来的，所有的RNN都具有一种重复神经网络模块的链式形式。

优点：

适合于处理和预测时间序列中间隔和延迟非常长的重要事件。

缺点：

参数量过大、易产生过拟合的问题。

2 传统的时序分析模型

自回归(Auto Regression, AR)
移动平均线(Moving Average, MA)
自回归移动平均线(Autoregressive Moving Average, ARMA)
自回归综合移动平均线(Autoregressive Integrated Moving Average, ARIMA)
季节性自回归整合移动平均线(Seasonal Autoregressive Integrated Moving Average, SARIMA)
具有外生回归量的季节性自回归整合移动平均线(Seasonal Autoregressive Integrated Moving-Average with Exogenous Regressors, SARIMAX)

自回归模型 AR

自回归模型（Autoregressive Model，简称 AR 模型）是一种时间序列分析方法，用于描述一个时间序列变量与其过去值之间的关系。AR模型假设当前观测值与过去的观测值之间存在线性关系，通过使用过去的观测值来预测未来的观测值。

优点：

简单性：AR模型是一种线性模型，易于理解和实现。它仅使用过去的观测值作为自变量，没有其他复杂的因素需要考虑。
建模能力：AR模型可以捕捉时间序列数据的自相关结构，即当前观测值与过去观测值之间的关系。它能够提供对未来观测值的预测，并揭示数据中的趋势和模式。

缺点：

只适用于平稳序列：AR模型要求时间序列是平稳的，即均值、方差和自相关不随时间变化。如果序列不平稳，可能需要进行差分操作或使用其他模型来处理非平稳性。
对过去观测值敏感：AR模型的预测结果受到过去观测值的影响，因此在处理长期预测时可能会出现误差累积的问题。较大的阶数可能会导致模型过拟合，而较小的阶数可能无法捕捉到时间序列的复杂动态。
无法处理季节性数据：AR模型无法直接处理具有明显季节性的时间序列。对于具有季节性模式的数据，可以使用季节性AR模型（SAR）或ARIMA模型进行建模。

移动平均法（MA）

移动平均法（MA）：该方法基于数据的平均数，并假设未来的值与过去的值之间具有一定的平稳性。

优点：

能够捕捉到时间序列数据中的移动平均关系。MA模型利用过去时间步白噪声误差项的线性组合来预测当前观测值，因此可以捕捉到数据中的移动平均性。

相对简单和直观。MA模型的参数表示过去时间步白噪声误差项的权重，可以通过估计这些权重来拟合模型。

缺点：

只能捕捉到移动平均关系，无法捕捉到自回归关系。MA模型忽略了过去时间步观测值，可能无法捕捉到数据中的自相关性。
对于某些时间序列数据，MA模型可能需要较高的阶数才能较好地拟合数据，导致模型复杂度增加。

自回归滑动平均模型

自回归滑动平均模型（ARMA模型，Auto-Regression and Moving AverageModel）是研究时间序列的重要方法，由自回归模型（AR模型）与滑动平均模型（MA模型）为基础“混合”而成，具有适用范围广、预测误差小的特点。

自回归差分移动平均线(Autoregressive Integrated Moving Average, ARIMA)

ARIMA模型全称为自回归差分移动平均模型（Autoregressive Integrated Moving Average Model）。ARIMA模型主要由三部分构成，分别为自回归模型（AR）、差分过程（I）和移动平均模型（MA）。

ARIMA模型的基本思想是利用数据本身的历史信息来预测未来。一个时间点上的标签值既受过去一段时间内的标签值影响，也受过去一段时间内的偶然事件的影响，这就是说，ARIMA模型假设：标签值是围绕着时间的大趋势而波动的，其中趋势是受历史标签影响构成的，波动是受一段时间内的偶然事件影响构成的，且大趋势本身不一定是稳定的

简而言之，ARIMA模型就是试图通过数据的自相关性和差分的方式，提取出隐藏在数据背后的时间序列模式，然后用这些模式来预测未来的数据。其中：

AR部分用于处理时间序列的自回归部分，它考虑了过去若干时期的观测值对当前值的影响。
I部分用于使非平稳时间序列达到平稳，通过一阶或者二阶等差分处理，消除了时间序列中的趋势和季节性因素。
MA部分用于处理时间序列的移动平均部分，它考虑了过去的预测误差对当前值的影响。

结合这三部分，ARIMA模型既可以捕捉到数据的趋势变化，又可以处理那些有临时、突发的变化或者噪声较大的数据。所以，ARIMA模型在很多时间序列预测问题中都有很好的表现。

优点：

模型十分简单，只需要内生变量而不需要借助其他外生变量。(所谓内生变量指的应该是仅依赖于该数据本身，而不像回归需要其他变量)

缺点：

要求时序数据是稳定的（stationary），或者是通过差分化(differencing)后是稳定的。

本质上只能捕捉线性关系，而不能捕捉非线性关系。

季节性自回归整合移动平均模型 SARIMA

SARIMA 是一种常用的时序分析方法，它是 ARIMA 模型在季节性数据上的扩展。SARIMA 模型可以用于预测季节性时间序列数据，例如每年的销售额或每周的网站访问量。下面是SARIMA模型的优缺点：

优点：

SARIMA模型可以很好地处理季节性数据，因为它考虑了时间序列数据中的季节性因素。
SARIMA模型可以对时间序列数据进行长期预测，因为它可以捕捉到数据中的趋势和周期性变化。
SARIMA模型可以用于多变量时间序列数据，因为它可以同时考虑多个变量之间的关系。

缺点：

SARIMA模型需要大量的历史数据来训练，因此在数据量较少的情况下可能不太适用。
SARIMA模型对异常值比较敏感，因此需要对异常值进行处理。
SARIMA模型的计算复杂度较高，需要进行大量的计算和优化。

具有外生回归量的季节性自回归整合移动平均模型 SARIMAX

具有外生回归量的季节性自回归整合移动平均模型(Seasonal Autoregressive Integrated Moving-Average with Exogenous Regressors, SARIMAX)是在差分移动自回归模型（ARIMA）的基础上加上季节（S,Seasonal）和外部因素(X,eXogenous)。也就是说以ARIMA基础加上周期性和季节性，适用于时间序列中带有明显周期性和季节性特征的数据。

3 其他时序模型

这类方法以 lightgbm、xgboost 为代表，一般就是把时序问题转换为监督学习，通过特征工程和机器学习方法去预测；这种模型可以解决绝大多数的复杂的时序预测模型。支持复杂的数据建模，支持多变量协同回归，支持非线性问题。

不过这种方法需要较为复杂的人工特征过程部分，特征工程需要一定的专业知识或者丰富的想象力。特征工程能力的高低往往决定了机器学习的上限，而机器学习方法只是尽可能的逼近这个上限。特征建立好之后，就可以直接套用树模型算法 lightgbm/xgboost，这两个模型是十分常见的快速成模方法，除此之外，他们还有以下特点：

计算速度快，模型精度高；
缺失值不需要处理，比较方便；
支持 category 变量；
支持特征交叉。

具体选择哪种方法需要根据数据的性质、问题的特点以及自身的经验和能力来综合考量。

需要根据具体的数据特征、问题要求和自身的能力来选择合适的时间序列预测方法。有时，结合多个方法可以提高预测的准确性和稳定性。同时，为了更好地选择模型和评估预测结果，对数据进行可视化分析和模型诊断也是很重要的。

Tags：算法点击:() 评论:()

声明：本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,不构成投资建议。投资者据此操作，风险自担。如有任何标注错误或版权侵犯请与我们联系，我们将及时更正、删除。

▌相关推荐

诱导付费、自动扣费……微短剧被质疑借助算法精准“围猎”老年人

诱导付费、自动扣费、重复收费……聚焦身边的消费烦心事⑦丨一些微短剧被质疑借助算法精准“围猎”老年人中工网北京3月31日电(工人日报—中工网记者刘兵)...【详细内容】

2024-04-01　　Search: 算法点击:(5)　　评论:(0)　　加入收藏

分析网站SEO快速排名算法对网站具体的影响效果

亲爱的朋友们，今天我想和大家分享一个我们都关心的话题——网站SEO快速排名算法对网站我们身处一个信息爆炸的时代，如何在海量的信息中脱颖而出，成为了一个我们不得...【详细内容】

2024-03-28　　Search: 算法点击:(11)　　评论:(0)　　加入收藏

当prompt策略遇上分治算法，南加大、微软让大模型炼成「火眼金睛」

近年来，大语言模型（LLMs）由于其通用的问题处理能力而引起了大量的关注。现有研究表明，适当的提示设计（prompt enginerring），例如思维链（Chain-of-Thoughts），可以解锁 LLM 在不同领域的...【详细内容】

2024-03-12　　Search: 算法点击:(12)　　评论:(0)　　加入收藏

谷歌宣布更新搜索算法：打击AI生成内容，提高搜索结果质量

IT之家 3 月 6 日消息，谷歌于当地时间 5 日发文宣布，针对用户对搜索结果质量下降的反馈，将对算法进行调整，旨在打击 AI 生成的内容以及内容农场等垃圾信息，使用户能够看到更多“...【详细内容】

2024-03-06　　Search: 算法点击:(36)　　评论:(0)　　加入收藏

小红书、视频号、抖音流量算法解析，干货满满，值得一看！

咱们中国现在可不是一般的牛！网上的网友已经破了十个亿啦！到了这个互联网的新时代，谁有更多的人流量，谁就能赢得更多的掌声哦~抖音、小红书、、视频号，是很多品牌必争的流量洼地...【详细内容】

2024-02-23　　Search: 算法点击:(12)　　评论:(0)　　加入收藏

雪花算法详解与Java实现：分布式唯一ID生成原理

SnowFlake 算法，是 Twitter 开源的分布式 ID 生成算法。其核心思想就是：使用一个 64 bit 的 long 型的数字作为全局唯一 ID。在分布式系统中的应用十分广泛，且 ID 引入了时间戳...【详细内容】

2024-02-03　　Search: 算法点击:(49)　　评论:(0)　　加入收藏

简易百科之什么是搜索引擎的PageRank算法？

简易百科之什么是搜索引擎的PageRank算法？在互联网时代，搜索引擎是我们获取信息的重要工具。而PageRank算法则是搜索引擎的核心技术之一，它决定了网页在搜索结果中的排名。那么...【详细内容】

2024-01-24　　Search: 算法点击:(49)　　评论:(0)　　加入收藏

PageRank算法揭秘：搜索引擎背后的魔法师的工作原理

PageRank(PR)算法是由谷歌创始人之一的拉里·佩奇LarryPage命名的一种衡量网站页面重要性的方法。根据谷歌的说法，PageRank通过计算页面链接的数量和质量来粗略估计分...【详细内容】

2024-01-23　　Search: 算法点击:(44)　　评论:(0)　　加入收藏

程序开发中常用的十种算法，你用过几种？

当编写程序时，了解和使用不同的算法对解决问题至关重要。以下是C#中常用的10种算法，每个算法都伴随着示例代码和详细说明。1. 冒泡排序 (Bubble Sort):冒泡排序是一种简单的比...【详细内容】

2024-01-17　　Search: 算法点击:(43)　　评论:(0)　　加入收藏

百度最新的搜索引擎算法是什么样的？

百度搜索引擎算法是百度用来决定网页排名的算法。它是百度搜索技术的核心，也是百度作为全球最大的中文搜索引擎的基石。随着互联网的发展和用户需求的不断变化，百度搜索引擎算...【详细内容】

2024-01-10　　Search: 算法点击:(85)　　评论:(0)　　加入收藏

▌简易百科推荐

小红书、视频号、抖音流量算法解析，干货满满，值得一看！

2024-02-23　　二手车小胖说　　　　Tags:流量算法　点击:(12)　　评论:(0)　　加入收藏

雪花算法详解与Java实现：分布式唯一ID生成原理

2024-02-03　　一安未来　　微信公众号　　Tags:雪花算法　点击:(49)　　评论:(0)　　加入收藏

程序开发中常用的十种算法，你用过几种？

2024-01-17　　架构师老卢　　今日头条　　Tags:算法　点击:(43)　　评论:(0)　　加入收藏

百度推荐排序技术的思考与实践

本文将分享百度在推荐排序方面的思考与实践。在整个工业界的推广搜场景上，特征设计通常都是采用离散化的设计，需要保证两方面的效果，一方面是记忆，另一方面是泛化。特征都是通过...【详细内容】

2024-01-09　　DataFunTalk　　微信公众号　　Tags:百度推荐　点击:(73)　　评论:(0)　　加入收藏

什么是布隆过滤器？如何实现布隆过滤器？

以下我们介绍了什么是布隆过滤器？它的使用场景和执行流程，以及在 Redis 中它的使用，那么问题来了，在日常开发中，也就是在 Java 开发中，我们又将如何操作布隆过滤器呢？布隆过滤器（Blo...【详细内容】

2024-01-05　　Java中文社群　　微信公众号　　Tags:布隆过滤器　点击:(87)　　评论:(0)　　加入收藏

面向推荐系统的深度强化学习算法研究与应用

随着互联网的快速发展，推荐系统在各个领域中扮演着重要的角色。传统的推荐算法在面对大规模、复杂的数据时存在一定的局限性。为了解决这一问题，深度强化学习算法应运而生。本...【详细内容】

2024-01-04　　数码小风向　　　　Tags:算法　点击:(87)　　评论:(0)　　加入收藏

非负矩阵分解算法：从非负数据中提取主题、特征等信息

非负矩阵分解算法（Non-negativeMatrixFactorization，简称NMF）是一种常用的数据分析和特征提取方法，主要用于从非负数据中提取主题、特征等有意义的信息。本文将介绍非负矩阵分解...【详细内容】

2024-01-02　　毛晓峰　　　　Tags:算法　点击:(62)　　评论:(0)　　加入收藏

再谈前端算法，你这回明白了吗？

楔子 -- 青蛙跳台阶一只青蛙一次可以跳上一级台阶，也可以跳上二级台阶，求该青蛙跳上一个n级的台阶总共需要多少种跳法。分析: 当n=1的时候，①只需要跳一次即可；只有一种跳法，即f(...【详细内容】

2023-12-28　　前端爱好者　　微信公众号　　Tags:前端算法　点击:(107)　　评论:(0)　　加入收藏

三分钟学习二分查找

二分查找是一种在有序数组中查找元素的算法，通过不断将搜索区域分成两半来实现。你可能在日常生活中已经不知不觉地使用了大脑里的二分查找。最常见的例子是在字典中查找一个...【详细内容】

2023-12-22　　小技术君　　微信公众号　　Tags:二分查找　点击:(78)　　评论:(0)　　加入收藏

强化学习算法在资源调度与优化中的应用

随着云计算和大数据技术的快速发展，资源调度与优化成为了现代计算系统中的重要问题。传统的资源调度算法往往基于静态规则或启发式方法，无法适应动态变化的环境和复杂的任务需...【详细内容】

2023-12-14　　职场小达人欢晓　　　　Tags:算法　点击:(164)　　评论:(0)　　加入收藏

推荐资讯

访问网站显示不安全是	掌握独立站SEO策略，提
快手蓝色小钥匙跳转微	微信朋友圈如何置顶
Facebook新用户扩展怎	详解微信里面的分期可
微信表情包更新：原创设	微信朋友圈功能大改版