百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术分类 > 正文

机器学习笔记-LSTM(长短时记忆网络)

ztj100 2024-12-12 16:15 12 浏览 0 评论

一 简介

LSTM网络,即长短期记忆网络,是循环神经网络(RNN)的一种高级形式,擅长捕捉数据中的长期依赖关系。

二 实现

(1)数据集:

百度网盘链接:https://pan.baidu.com/s/1oHPLWcs3XnFqJnJfKcLStQ

提取码:clyz

(2)环境:pytorch、sklearn、pandas、matplotlib、numpy

(3)导入包:

import pandas as pd
from matplotlib import pyplot as plt # 结果可视化
from torch import nn
import time
import matplotlib.pyplot as plt
import numpy as np
from typing import Tuple
from sklearn.preprocessing import MinMaxScaler
import torch

(4)设置显示中文:

plt.rcParams['font.sans-serif'] = 'SimHei'
plt.rcParams['axes.unicode_minus'] = False

(5)定义网络:

class LSTM_Regression(nn.Module):
    """
        使用LSTM进行回归
        参数:
        - input_size: 输入维度
        - hidden_size: 隐藏层维度
        - output_size: 输出维度
        - num_layers: cell的层数
        - dropout: 遗忘率
        - learning_rate: 学习率
        - batch_size: 批大小
    """
 
    def __init__(self, input_size, hidden_size, output_size=1, num_layers=2, dropout=0.2, learning_rate=0.001, batch_size=32):
        super().__init__()
 
        self.lstm = nn.LSTM(input_size, hidden_size, num_layers)  # LSTM层
        self.fc = nn.Linear(hidden_size, output_size)  # 全连接层
 
    def forward(self, _x):
        x, _ = self.lstm(_x)  # 输入数据和隐藏层输出
        s, b, h = x.shape  # 输入数据的形状
        x = x.view(s * b, h)  # 展开输入数据
        x = self.fc(x)  # 全连接层
        x = x.view(s, b, -1)  # 还原输入数据的形状
        return x

(6)定义数据集:

def create_dataset(data, days_for_train=5) -> Tuple[np.array, np.array]:
    """
        根据给定的序列data,生成数据集
        数据集分为输入和输出,每一个输入的长度为days_for_train,每一个输出的长度为1。
        也就是说用days_for_train天的数据,对应下一天的数据。
        若给定序列的长度为d,将输出长度为(d-days_for_train+1)个输入/输出对
    """
    dataset_x, dataset_y = [], []
    for i in range(len(data) - days_for_train):
        _x = data[i:(i + days_for_train)]
        dataset_x.append(_x)
        dataset_y.append(data[i + days_for_train])
    return (np.array(dataset_x), np.array(dataset_y))

(7)读取并查看数据:

 # 读取数据
    data = pd.read_csv('D:/myfile/myWorkSpace/参与的项目/备品备件-07.05/0708预处理/0718_datas/02/电力负荷.csv')

    # 转换为时间格式
    data['出库日期'] = pd.to_datetime(data['出库日期'])
    # print(data.head())
    df = data.rename(columns={'出库日期': 'ds', '数量和': 'y'})
    plt.plot(df['y'])
    plt.show()

(8)MinMaxScaler数据归一化

    # 创建一个MinMaxScaler实例
    scaler = MinMaxScaler()
    # 使用fit_transform方法来拟合数据并进行转换
    df_normalized = scaler.fit_transform(df['y'].values.reshape(-1, 1))

    plt.plot(df_normalized)
    plt.show()

(9)获取并打印数据集:

dataset_x, dataset_y = create_dataset(df_normalized, DAYS_FOR_TRAIN)
print(dataset_x.shape, dataset_y.shape)

(10)数据集准备:

        train_size = int(len(dataset_x) * 0.8)
    
        train_x = dataset_x[:train_size]
        train_y = dataset_y[:train_size]

        # 将数据改变形状,RNN 读入的数据维度是 (seq_size, batch_size, feature_size)
        train_x = train_x.reshape(-1, 1, DAYS_FOR_TRAIN)
        train_y = train_y.reshape(-1, 1, 1)

        # 转为pytorch的tensor对象
        train_x = torch.from_numpy(train_x).to(torch.float32) 
        train_y = torch.from_numpy(train_y).to(torch.float32) 

(11)使用模型:

model = LSTM_Regression(DAYS_FOR_TRAIN, 60, output_size=1, num_layers=2, dropout=0.2, learning_rate=0.001, batch_size=32) 

(12)开始训练:

        train_loss = []
        loss_function = nn.MSELoss()
        optimizer = torch.optim.Adam(model.parameters(), lr=1e-2, betas=(0.9, 0.999), eps=1e-08, weight_decay=0)

        for i in range(200):
            out = model(train_x)
            loss = loss_function(out, train_y)
            loss.backward()
            optimizer.step()
            optimizer.zero_grad()
            train_loss.append(loss.item())

(13)绘制损失曲线:

        # loss曲线
        plt.figure()
        plt.plot(train_loss, 'b', label='loss')
        plt.title("Train_Loss_Curve")
        plt.ylabel('train_loss')
        plt.xlabel('epoch_num')
        plt.legend()
        plt.show()

(14)模型评估:

        model = model.eval()  # 转换成评估模式
        # 注意这里用的是全集 模型的输出长度会比原数据少DAYS_FOR_TRAIN 需要填充使长度相等
        dataset_x = dataset_x.reshape(-1, 1, DAYS_FOR_TRAIN)  
        dataset_x = torch.from_numpy(dataset_x).to(torch.float32)  # 转为pytorch的tensor对象
    
        pred_test = model(dataset_x)  # 全量训练集
        pred_test = pred_test.view(-1).data.numpy()
        pred_test = np.concatenate((np.zeros(DAYS_FOR_TRAIN), pred_test))  # 填充0 使长度相同

(15)逆变换预测结果:

# 逆变换预测结果
preds = scaler.inverse_transform(pred_test.reshape(-1, 1))
reals = scaler.inverse_transform(df_normalized.reshape(-1, 1))

(16)绘图(预测值-实际值):

(17)计算准确率:

       # 计算准确率
        errors = abs(preds - reals)

        errors_01 = [e < t * 0.01 for e, t in zip(errors, reals)]
        errors_03 = [e < t * 0.03 for e, t in zip(errors, reals)]
        errors_05 = [e < t * 0.05 for e, t in zip(errors, reals)]
        errors_10 = [e < t * 0.10 for e, t in zip(errors, reals)]
        errors_15 = [e < t * 0.15 for e, t in zip(errors, reals)]

        count_01 = np.mean(errors_01)
        count_03 = np.mean(errors_03)
        count_05 = np.mean(errors_05)
        count_10 = np.mean(errors_10)
        count_15 = np.mean(errors_15)

        print("误差 1%: ", count_01)
        print("误差 3%: ", count_03)
        print("误差 5%: ", count_05)
        print("误差 10%: ", count_10)
        print("误差 15%: ", count_15)

三 小结

模型没有进行任何处理,直接预测的结果较好,如果想进一步提高模型的精度,需要进行参数调整:

  • 隐藏状态维度(hidden size/dimension):定义LSTMLSTM记忆细胞的容量。较大的隐藏尺寸可以捕获更复杂的信息,但也会增加计算成本和过拟合的风险。
  • 层数(num_layers):LSTM层的数量。增加层数可以学习更深层次的特征表示,但也可能带来梯度消失/爆炸问题,并增加训练时间和计算资源需求。
  • 学习率(learning rate):这是优化器在梯度下降过程中更新权重的步长。选择合适的学习率很关键,过高可能导致训练不稳定,过低则收敛速度慢。常见的初始学习率范围为10e-2至10e?4,并可能在训练过程中动态调整。
  • 批量大小(batch size):每次迭代时处理的数据样本数量。较大的批量可以加速计算,但可能会导致泛化能力降低和内存需求增加。较小的批量提供了更好的泛化能力,但训练速度较慢。
  • 激活函数:虽然不是直接的超参数,但选择不同的激活函数(如tanh、ReLU或softsign)会影响模型的训练动态和性能。
  • 优化器(optimizer):如Adam、RMSprop、SGD等,不同的优化器有不同的更新规则,影响学习效率和最终性能。
  • dropout比例:在训练过程中随机“丢弃”一部分神经元以减少过拟合,常见的dropout比例为0.2至0.5。
  • 序列长度(sequence length):对于时间序列数据,决定输入序列的长度,可能影响模型理解和捕捉长期依赖的能力。

相关推荐

使用Python编写Ping监测程序(python 测验)

Ping是一种常用的网络诊断工具,它可以测试两台计算机之间的连通性;如果您需要监测某个IP地址的连通情况,可以使用Python编写一个Ping监测程序;本文将介绍如何使用Python编写Ping监测程...

批量ping!有了这个小工具,python再也香不了一点

号主:老杨丨11年资深网络工程师,更多网工提升干货,请关注公众号:网络工程师俱乐部下午好,我的网工朋友。在咱们网工的日常工作中,经常需要检测多个IP地址的连通性。不知道你是否也有这样的经历:对着电脑屏...

python之ping主机(python获取ping结果)

#coding=utf-8frompythonpingimportpingforiinrange(100,255):ip='192.168.1.'+...

网站安全提速秘籍!Nginx配置HTTPS+反向代理实战指南

太好了,你直接问到重点场景了:Nginx+HTTPS+反向代理,这个组合是现代Web架构中最常见的一种部署方式。咱们就从理论原理→实操配置→常见问题排查→高级玩法一层层剖开说,...

Vue开发中使用iframe(vue 使用iframe)

内容:iframe全屏显示...

Vue3项目实践-第五篇(改造登录页-Axios模拟请求数据)

本文将介绍以下内容:项目中的public目录和访问静态资源文件的方法使用json文件代替http模拟请求使用Axios直接访问json文件改造登录页,配合Axios进行登录请求,并...

Vue基础四——Vue-router配置子路由

我们上节课初步了解Vue-router的初步知识,也学会了基本的跳转,那我们这节课学习一下子菜单的路由方式,也叫子路由。子路由的情况一般用在一个页面有他的基础模版,然后它下面的页面都隶属于这个模版,只...

Vue3.0权限管理实现流程【实践】(vue权限管理系统教程)

作者:lxcan转发链接:https://segmentfault.com/a/1190000022431839一、整体思路...

swiper在vue中正确的使用方法(vue中如何使用swiper)

swiper是网页中非常强大的一款轮播插件,说是轮播插件都不恰当,因为它能做的事情太多了,swiper在vue下也是能用的,需要依赖专门的vue-swiper插件,因为vue是没有操作dom的逻辑的,...

Vue怎么实现权限管理?控制到按钮级别的权限怎么做?

在Vue项目中实现权限管理,尤其是控制到按钮级别的权限控制,通常包括以下几个方面:一、权限管理的层级划分...

【Vue3】保姆级毫无废话的进阶到实战教程 - 01

作为一个React、Vue双修选手,在Vue3逐渐稳定下来之后,是时候摸摸Vue3了。Vue3的变化不可谓不大,所以,本系列主要通过对Vue3中的一些BigChanges做...

Vue3开发极简入门(13):编程式导航路由

前面几节文章,写的都是配置路由。但是在实际项目中,下面这种路由导航的写法才是最常用的:比如登录页面,服务端校验成功后,跳转至系统功能页面;通过浏览器输入URL直接进入系统功能页面后,读取本地存储的To...

vue路由同页面重定向(vue路由重定向到外部url)

在Vue中,可以使用路由的重定向功能来实现同页面的重定向。首先,在路由配置文件(通常是`router/index.js`)中,定义一个新的路由,用于重定向到同一个页面。例如,我们可以定义一个名为`Re...

那个 Vue 的路由,路由是干什么用的?

在Vue里,路由就像“页面导航的指挥官”,专门负责管理页面(组件)的切换和显示逻辑。简单来说,它能让单页应用(SPA)像多页应用一样实现“不同URL对应不同页面”的效果,但整个过程不会刷新网页。一、路...

Vue3项目投屏功能开发!(vue投票功能)

最近接了个大屏项目,产品想在不同的显示器上展示大屏项目不同的页面,做出来的效果图大概长这样...

取消回复欢迎 发表评论: