Informer复现--数据篇

本文为博客 VIP 文章,开通 VIP 后可阅读全文

开通 VIP

原文首发在公众号 AI天天用,欢迎关注,共同进步。

应朋友所托,复现Informer代码。没想到后来还吃到瓜了。如果您也有需要复现的文章(ns子刊,顶刊顶会为主),麻烦您关注公众号留言。

Informer是2021年AAAI会议的最佳论文,用于处理长时间序列预测。 由于发表时间较早,当前一些比较简单高效的命令尚未出现。 此外,原代码中涉及巨多的参数设置,对于理解代码而言非常不容易。 基于此,可复现Informer的代码,以便更好地理解文章。 这篇博文先复现数据部分。

Informer论文

原始代码地址: https://github.com/zhouhaoyi/Informer2020/tree/main

部分参数说明(大概40多个):

部分参数说明

原始代码中,数据部分主要涉及3个文件,data/loader_loader.pyexp/exp_informer.py, 以及utils/timefeatures.py。对于初学者而言,大量的参数以及数据处理的复杂性可能已吓退了不少同学。而将关于数据的代码放在不同的文件夹下,也增加了复现和理解数据处理和加载的难度。

我们以ETTh1.csv文件为例,重写数据部分代码。 首先,设置所有数据存储的主文件夹,一般命名为datasetsdata等。

dataroot = "informer/datasets"  # 数据文件夹路径
datafile = "ETTh1.csv"          # 文件名

根据数据文件夹和数据名,即可读取数据

df = pd.read_csv(os.path.join(dataroot, datafile), parse_dates=[0], index_col=0)
df.head()

数据首行

数据尾行</

ETDataset 数据集预处理实战:从原始CSV到PyTorch DataLoader的5个关键步骤 本文详细介绍了ETDataset数据集预处理的5个关键步骤,从原始CSV文件到PyTorch DataLoader的完整流程。涵盖数据加载、时间戳处理、特征工程、缺失值处理及构建时序样本等核心环节,特别针对电力变压器温度预测这一时间序列任务进行了优化,为研究者提供了实用的工程化解决方案。 阅读详情

相关推荐

Informer时序模型(代码解析)

Informer时序模型代码解析,结合代码理解作者在Transformer模型上做了哪些改进

qq_20144897的博客 2万+

时间序列预测-Transformer,Informer,Autoformer,FEDformer复现结果

时间序列预测-Transformer,Informer,Autoformer,FEDformer复现结果

Informer-LSTM模型详解及代码复现

这种融合方式使得模型能够同时利用Informer的全局信息提取能力和LSTM的局部时序关系建模能力,从而提高预测的准确性和鲁棒性。通过这些创新的结构设计,Informer-LSTM模型成功地克服了传统时间序列预测模型的局限性,为处理复杂的时序数据提供了一种高效且准确的解决方案。在Informer-LSTM模型的融合架构中,信息流的传递方式是一个关键设计,它直接影响了模型的性能和效率。通过精心设计的数据预处理流程,可以为Informer-LSTM模型提供高质量的输入数据,从而提高模型的预测性能和训练效率。

hasakie的博客 1572

Informer2020:AAAI 2021接受论文“ Informer”的GitHub存储库

告密者:用于长序列时间序列预测的超越高效变压器(AAAI'21最佳论文) 这是以下文章中Informer的原始Pytorch实现: 。 特别感谢 Jieqi Peng @ 建立此存储库。 :triangular_flag: 新闻(2021年2月22日):我们提供了供友好使用。 :triangular_flag: 新闻(2021年2月8日):我们的线人论文被授予! 我们将继续进行这方面的研究,并对此仓库进行更新。 如果您发现我们的工作对您有帮助,请加注该回购并引用我们的论文。 图1. Informer的体系结构。 稀疏注意 自我注意分数形成一个长尾分布,其中“活动”查询位于“头”分数中,而“懒惰”查询位于“尾”区域中。 我们设计了ProbSparse Attention以选择“活动”查询而不是“惰性”查询。 带有Top-u查询的ProbSparse Attention通过概率分布形成了一个稀疏的Transformer。 Why not us

CGAN—LSGAN的原理与实现与informer代码理解(1)

文章目录摘要一. 摘要 一.

weixin_44790306的博客 3663

AAAI最佳论文Informer 复现(含python notebook代码)

Informer 算法复现代码 含notebook

fluentn的博客 4052

记录复现Informer修改数据集遇到的问题FileNotFoundError: [Errno 2] No such file or directory: ‘./data/WTH.csv‘

代码中路径没错但是运行报错:FileNotFoundError: [Errno 2] No such file or directory: './data/WTH.csv'

weixin_47902668的博客 1256

Informer复现+实现自己的数据

笔记:记录一下实现Informer时序预测的过程,同时加注一些要点,并加上构建自己数据集进行预测的过程。内容:1、Informer论文解读、复现。2、构建自己的数据集。3、利用Informer数据集进行预测。

Kequan的博客 7945

Informer模型复现项目实战

稀疏自注意力机制:Informer模型的一个核心创新点是它引入了稀疏自注意力机制(ProbSparse Attention),通过选择性地关注最具信息量的注意力头,显著减少了全局自注意力的计算复杂度。传统Transformer模型在处理长序列数据时,计算复杂度为O(L2)O(L^2)O(L2),而Informer通过引入稀疏性使得复杂度降低到O(Llog⁡L)O(L \log L)O(LlogL),特别适合长时间序列的高效处理。多尺度卷积堆叠。

1642

Informer复现 -- 训练及吃瓜

想吃瓜的同学,直接往后看。

AI_daily的博客 1038

模型实践| Informer 上手实践

近年来的研究表明,Transformer具有提高预测能力的潜力。然而,Transformer也存在几个问题,使其不能直接适用于LSTF问题,例如时间复杂度、高内存使用和“编码-解码”体系结构的固有局限性。为了解决这些问题,作者基于Transformer设计了一种适用于LSTF问题的模型,即Informer模型,该模型具有三个显著特征:ProbSpare self-attention机制,有效降低了时间复杂度和内存使用量。

weixin_66945478的博客 5865

Informer2020论文复现指南:从数学公式到代码实现

你是否还在为长序列时间序列预测(Long Sequence Time-Series Forecasting, LSTF)任务中Transformer模型的计算复杂度和内存占用问题而困扰?作为AAAI'21最佳论文,Informer模型通过创新的ProbSparse自注意力机制,成功将Transformer的时间复杂度从O(L²)降低到O(L log L),同时保持甚至超越传统Transformer...

gitblog_00283的博客 1217

Informer讲解PPT介绍【超详细】--AAAI 2021最佳论文:比Transformer更有效的长时间序列预测

本章再次重温informer 的重点细节,对Informer模型的问题背景与应用数据场景有了更进一步理解,按作者的表达,适用于具有周期性的数据集,适合做一个较长的时序预测,如果过于短期的预测反而不能很好的体现informer应有的性能。继续从三大挑战出发,提出三点对应的处理方法,从数学推导到实际模型验证的过程。以及论文源码中出现的一些小技巧的学习,比如 EarlyStopping的原理与使用技巧。Reference: 1.细读informer与项目学习 2. 类Transformer模型的长序列分析预测新方

weixin_44790306的博客 9028

Informer复现 路径转换

Informer复现文件地址问题

weixin_43717832的博客 373

【论文复现】完爆LSTM!飞桨搭建Informer长时间序列模型

由领航团团长手把手教你用PaddlePaddle搭建Informer长时间序列模型(2021 AAAI最佳论文)

m0_63642362的博客 2800

(pytorch进阶之路)Informer

论文:Informer: Beyond Efficient Transformer for Long Sequence Time-Series Forecasting (AAAI’21 Best Paper)看了一下以前的论文学习学习

qq_19841133的博客 2299

时间序列预测模型实战案例(八)(Informer)个人数据集、详细参数、代码实战讲解

博客带大家看的是Informer模型进行时间序列预测的实战案例,它是在2019年被提出并在ICLR 2020上被评为Best Paper,可以说Informer模型在当今的时间序列预测方面还是十分可靠的,Informer模型的实质是注意力机制+Transformer模型,Informer模型的核心思想是将输入序列进行自注意力机制的处理,以捕捉序列中的长期依赖关系,并利用Transformer的编码器-解码器结构进行预测,通过阅读本文你可以学会利用个人数据集训练模型。

Snu77的博客 4万+

informer自定义数据

假设数据维度是317天的数据,滑动窗口为120天预测未来20天数据,num_train = 221 , num_test = 63 ,num_vali = 33 , border1s = [0, 101, 134] ,border2s = [221, 254, 317],这可以设置为s,t,h,d,b,w,m(s:秒,t:分钟,h:小时,d:每天,b:工作日,w:每周,m:每月)。这可以设置为M、S、MS(M:多变量预测多变量,S:单变量预测单变量,MS:多变量预报单变量)否则将是获得一个标准化的预测。

u012254599的博客 2125
下一篇: Informer复现--模型之Attention
博师联盟
博客等级 码龄2年 106粉丝 4原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值