首页 > 其他分享 >拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归

时间：2022-11-27 22:01:08浏览次数：77

标签：典型 medoids 提取 tecdat GAM 聚类序列方法我们

通过对用电负荷的消费者进行聚类，我们可以提取典型的负荷曲线，提高后续用电量预测的准确性，检测异常或监控整个智能电网（Laurinec等人（2016），Laurinec和Lucká（ 2016））。第一个用例通过K-medoids聚类方法提取典型的电力负荷曲线。

有50个长度为672的时间序列（消费者），长度为2周的耗电量的时间序列。这些测量来自智能电表。

维数太高，并且会发生维数的诅咒。因此，我们必须以某种方式降低维度。最好的方法之一是使用时间序列表示，以减少维数，减少噪声并提取时间序列的主要特征。

对于用电的两个季节性时间序列（每日和每周季节性），基于模型的表示方法似乎具有提取典型用电量的最佳能力。

让我们使用一种基于模型的基本表示方法- 平均季节性。在此还有一个非常重要的注意事项，对时间序列进行归一化是对时间序列进行每次聚类或分类之前的必要步骤。我们想要提取典型的消耗曲线，而不是根据消耗量进行聚类。

维数上已大大降低。现在，让我们使用K-medoids聚类方法来提取典型的消耗量概况。由于我们不知道要选择合适的簇数，即先验信息，因此必须使用验证指数来确定最佳簇数。我将使用众所周知的Davies-Bouldin指数进行评估。通过Davies-Bouldin指数计算，我们希望找到其最小值。

我将群集数的范围设置为2-7。

让我们绘制评估的结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_时间序列_02

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_03

群集的“最佳”数目是7。

让我们绘制有7个聚类的聚类结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_04

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_05

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_06

我们可以看到5个典型的提取轮廓（簇的中心）。接下来的两个簇可以称为离群值。

现在，让我们尝试一些更复杂的方法来提取季节 GAM回归系数。我们可以提取每日和每周的季节性回归系数。

## [1] 50 53

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_07 由于GAM方法中使用样条曲线。让我们对数据进行聚类并可视化其结果。

让我们绘制评估的结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_时间序列_08

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_09

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_10

聚类的最佳数目为7。让我们绘制结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_11

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_12

提取的消费数据比平均季节性数据更平滑。现在，K 中心提取了4个典型的轮廓，并确定了3个簇。

我展示一些自适应表示的聚类结果，让我们以DFT（离散傅立叶变换）方法为例，并提取前48个DFT系数。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_13

让我们绘制评估的结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_14

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_时间序列_15 我们可以在4个簇中看到漂亮的“肘部”。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_时间序列_16

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_17

这些结果难以解释。因此，基于模型的时间序列表示在此用例中非常有效。

建议在每天的时间序列中使用与FeaClip一起的窗口方法。最大的优点是不需要与FeaClip方法一起进行标准化。

dim(data_feaclip)

## [1]  50 112

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_18

让我们绘制评估的结果。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_数据_19

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_20

我们可以看到现在出现了2个“肘部”。最大的变化是在2到3之间，因此我将选择3。

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_21

拓端tecdat|R语言代写对用电负荷时间序列数据进行K-medoids聚类建模和GAM回归_聚类_22

可分离性似乎好于DFT。但是也可以检查具有不同数量集群的其他结果。

结论

在本教程中，我展示了如何使用时间序列表示方法来创建消费者的更多特征文件。然后，用时间序列进行K-medoids聚类，并从创建的聚类中提取典型的消耗曲线。

如果您有任何疑问，请在下面发表评论。

标签：典型,medoids,提取,tecdat,GAM,聚类,序列,方法,我们
From： https://blog.51cto.com/u_14293657/5890437

相关文章

拓端tecdat|R语言代写文本挖掘NASA数据网络分析，tf-idf和主题建模
R语言代写文本挖掘NASA数据网络分析，tf-idf和主题建模 NASA托管和/或维护了超过32,000个数据集; 这些数据集涵盖了从地球科学到航空航天......
拓端tecdat|R语言代写文本挖掘tf-idf,主题建模，情感分析,n-gram建模研究
我们将对1993年发送到20个Usenet公告板的20,000条消息进行分析。此数据集中的Usenet公告板包括新闻组用于政治，宗教，汽车，体育和密码学等主题。预处理我们首先阅读20ne......
拓端tecdat|R语言代写周氏检验(Chow test) 检验回归中结构不稳定性的虚拟变量的替代方
全球化时代快速增长的经济体之一是埃塞俄比亚经济。在低收入国家中，它已成为在国内生产总值（GDP）中实现两位数增长率的少数几个国家之一。然而，关于两位数的增长率存在很多争论，......
拓端tecdat|R语言代码编写偏最小二乘回归PLS-DA
R语言中的偏最小二乘回归PLS-DA主成分回归（PCR）的方法本质上是使用第一个方法的普通最小二乘（OLS）拟合来自预测变量的主成分（PC）。这带来许多优点：预测变......
拓端tecdat|R语言代写大数据分析纽约市的311万条投诉统计可视化与时间序列分析
R语言大数据分析纽约市的311万条投诉统计可视化与时间序列分析介绍本文并不表示R在数据分析方面比Python更好或更快速，我本人每天都使用两种语......
拓端tecdat|用于NLP的Python代写辅导：使用Keras的多标签文本LSTM神经网络分类
用于NLP的Python：使用Keras的多标签文本LSTM神经网络分类介绍在本文中，我们将看到如何开发具有多个输出的文本分类模型。我们将开发一个文本分类......
拓端tecdat|R语言代码编写析因设计分析：线性模型中的对比
R语言析因设计分析：线性模型中的对比对比度可用于对线性模型中的处理进行比较。常见的用途是使用析因设计时，除析因设计外还使用控制或检查处理。在......
拓端tecdat|适用于NLP自然语言处理的Python代写：使用Facebook FastText库
适用于NLP自然语言处理的Python：使用FacebookFastText库在本文中，我们将研究FastText，它是用于单词嵌入和文本分类的另一个极其有用的模块......
拓端tecdat|R语言代码编写逻辑回归、方差分析、伪R平方分析
R语言逻辑回归、方差分析、伪R平方分析目录怎么做测试假设条件并非所有比例或计数都适用于逻辑回归分析过度分散伪R平方测试p值Logistic回归示......
拓端tecdat|R语言编程指导预测人口死亡率：用李·卡特模型、非线性模型进行平滑估计
R语言预测人口死亡率：用李·卡特模型、非线性模型进行平滑估计今天早上，我和同事一起分析死亡率。我们在研究人口数据集，可以观察到很多波动性。......

赞助商

阅读排行