一种基于集成模型的烧结能耗预测方法

xiaoxiao2020-10-23  20

一种基于集成模型的烧结能耗预测方法
【技术领域】
[0001] 本发明设及钢铁企业烧结过程能耗预测领域,尤其是设及一种基于集成模型的烧 结能耗预测方法。
【背景技术】
[0002] 烧结是钢铁企业中耗能最大的工序之一,虽然近年来国内重点钢铁企业烧结工序 能耗逐年降低,但其与国外先进值还有较大差距,并且国内各钢铁企业之间能耗水平差异 明显,故研究烧结工序节能降耗意义重大。在W降低能耗和成本为导向的烧结配料优化和 工艺参数优化研究中,烧结能耗预测是其中的关键问题之一。烧结工序能耗主要包括电力 消耗和非电力消耗,其中非电力能耗包括固体燃料消耗、点火煤气消耗两大类,占到总能耗 的80%~90%,是研究烧结降耗的主要方向。目前,国内外现存的烧结能耗预测方法都存 在一定缺陷;输入参数难W确定,建模方法精度不足等,都影响着烧结能耗预测的精度和时 效。烧结能耗预测的难点在于;1)特征难W确定。能耗的影响因素错综复杂,难W简单通过 机理和经验确定,需要从众多因素中择取有用信息,剔除冗余变量,获得更精准的模型输入 参数。2)单一方法精度不足。实际生产中能耗数据波动较大,在其内在机理不能完全阐明 的情况下,单一预测方法很难获得较好的预测精度,需要进行多种方法和技术的集成研究。
[0003] 通过对现有技术的检索发现,针对烧结领域能耗预测而提出的方法很少,针对其 他领域类似问题所提出的方法可W借鉴。中国专利"一种能源消耗预测方法及装置"(授权 号;CN103544544A)中,杨海东等人针对企业电力需求预报提出了一种基于SVR的能耗预测 方法。该方法利用历史能耗数据构建训练样本集,其中的能耗数据按时间序列排列,通过选 择最佳的输入阶数获得最佳的预测模型,经对比验证该方法能够较好地预测未来电力需求 值。然而,从验证结果看该单一预测模型的精度仍有待提高。中国专利"一种基于Bagging 的浆纱过程上浆率软测量方法"(授权号;CN103018426A)中,田慧欣将bagging集成技术 用于上浆率的预测中,提出了基于SVR的集成预测模型,进一步提高了单一SVR的预测准确 度。不过,该发明在确定模型输入参数时,仅采用机理分析和经验判断的方法。对于钢铁企 业烧结过程,其中影响能耗变化的因素复杂多样,难W通过机理分析确定影响能耗的显著 特征,而仅凭经验判断缺乏理论依据,因而需要更为客观有效的参数选择方法。

【发明内容】

[0004] 本发明的目的就是为了克服上述现有技术存在的缺陷而提供一种预测结果精确、 时间效率高的基于集成模型的烧结能耗预测方法。
[0005] 本发明的目的可W通过W下技术方案来实现:
[0006] -种基于集成模型的烧结能耗预测方法,该方法包括W下步骤:
[0007] 1)基于RRelie巧的特征选择算法进行模型特征选择;
[0008] 2)根据所选模型特征的历史数据,建立改进极限学习机智能预测模型和回归型支 持向量机智能预测模型;
[0009] 3)对多个单一智能预测模型进行加权集成,获得集成后的烧结能耗预测值。
[0010] RRelie巧算法则用于处理目标属性为连续值的回归问题,假设样本空间S的规模 为m,随机选择一个样本Di(i= 1,2,. . .,m),并计算出其最近的k。。。,个近邻样本Sk,同时, 假设样本的预测值为T(?)。根据贝叶斯定理,特征属性A的权重可由下式得到:
[0011]
[001引该里PdiffA= (diff(A,D^Dj.)iDj.GSk)是样本Di与其knear个近邻样本之间特征属 性A差异的概率;PdiffT= (diff(T|DjGSk)是Di与其k。。。,个近邻样本之间预 测指标值T(?)差异的概率;P"ffT帖fA= (diff(T(.),D^Dj') |diff(A,Di,Dj'),Dj'GSk)表 示在已知Di与其k。。。,个近邻样本之间特征属性A差异的情况下其预测指标值T(?)差异 的条件概率;P化化fA=(diff(T( ? ),D。Dj) ?diff(A,D。Dj)|DjGSk)表示Di与其k"ear 个近邻样本之间特征属性A差异和其预测指标值T(?)差异的概率。该里,
[0013]
[0014] 其中value(A,Di)、value(A,Dj)是样本Di、Dj中特征属性A的值;max(A)和min(A) 是Di和它k。。。,个近邻样本中属性A的最大和最小值。diff(T( ? ),Di,Dp与之同理。
[0015] 所述步骤1)具体为:
[0016] SteplOl;参数初始化,令i= 1,j= 1 ;
[0017] Stepl02 ;在规模为m的样本空间S中选择样本町,从剩余的m-1个样本中选出离 该样本Di距离最近的k。。"个样本,组成近邻样本集Sk;
[0018]St巧103 ;从Sk中选择样本DJ,迭代计算不同预测值下的权重NdiffT;
[001 引NdiffT=N"ffT+diff(T( ? ),Di,Dj')/lw
[0020] 其中,T( ?)为样本的预测值;
[0021] St巧104;对每个特征属性A,迭代计算不同特征属性的权重NduaW及不同预测值 与不同特征属性的权重NdiffTMiffA:
[002引 N"f曲-N"ffA+diff(A,D。Dj)/knear
[002引 N"ffT&diffA-NdiffTMiffA+diff(T( ? ) ,D。Dj') ?diff(A,D。Dj')/knear
[0024] St巧105 ;令i=i+1,j=j+1,判断j是否满足j《knear,若是,则返回St巧103, 若否,则执行Steploe;
[00巧]St巧106 ;判断i是否满足i《m,若是,贝ij返回St巧101,若否,则执行St巧107 ;
[0026] St巧107 ;对于每个属性A,计算每个特征属性的最终权重估计;
[0027] W[A] -N"ffTT- (N"ffT_N"ffT&diffA) / (m-NdiffT)
[0028] 最后根据权重选择模型的特征属性。
[0029] 所述改进极限学习机智能预测模型的建立过程为:
[0030] Stepal;确定子学习机的个数M;
[003。Stepa2;用Bootstrap方法从训练数据集B中有放回抽样,得到每个子学习机的训 练数据集Bk,k= 1,…,M,且Bk与B规模相同,都为N;
[00础Stepa3 ;依次用Bk训练相应的子学习机,得到M个训练结果,并分别用统一的测试 数据集C检验预测精度;
[0033] Stepa4;用平均法对所有子学习机训练结果进行集成,得到最终结果,并验证模型 精度。
[0034] 所述回归型支持向量机智能预测模型的建立过程为:
[00巧]Stepbl;对原始数据进行归一化处理:
[0036]
[0037] 其中,Qp为各因素的第P个值,P= 1,…,N,Qm"、Qmi。分别为各因素中的最大值和 最小值,a、d为参数,d= (1-a) /2 ;
[0038] Stepb2 ;采用RBF核函数,确定SVR模型的参数并训练网络;
[0039] Stepb3 ;用测试数据集C测试网络的精度,得到网络预测输出值,然后进行反归一 化:
[0040]
[0041] 其中,式为第q个测试样本的网络输出值,L为测试数据集样本个数,欠为第q个 测试样本反归一化后的预测值,q= 1,2, . . .,L;
[0042] Stepb4 ;对SVR模型进行性能评价。
[0043] 所述步骤3)中,采用信息滴对多个单一智能预测模型进行加权集成,具体为:
[0044] Step301 ;计算各智能预测模型所获得的预测结果的变异程度:
[0045]
[004引其中,e。。、5V表示第U个模型第q个样本的相对误差值和预测输出值,y。表示第q个样本期望输出,q= 1,2, . . .,LL为测试数据集样本个数,U= 1,2,分别代表改进极限 学习机智能预测模型和回归型支持向量机智能预测模型;
[0047] St巧302 ;计算各智能预测模型的滴值: [0048]
[0049] 其中,Pud为第q个样本的第U个模型的预测相对误差比值,
[0050] Step303 ;计算各智能预测模型的权值;
[0051]
[00閲其中,Zu表示第U个模型的权值;
[0053] St巧304 ;计算各模型的加权集成输出;
[0054]
[00 巧]
[0056] 与现有技术相比,本发明的优点在于:
[0057] 1)本发明运用RRelie巧算法提取烧结能耗特征因素,较之W往仅凭人工经验确 定更具有理论依据,提高了预测结果的精确性;
[0058] 2)本发明采用多种智能预测算法进行加权集成,可有效实现烧结能耗的精准预 测;
[0059] 3)基于信息滴的加成集成思想融合多种预测模型的优势,进一步提高了模型精 度,并具有较高的时间效率。
【附图说明】
[0060] 图1为本发明的原理示意图;
[006。 图2为本发明基于RRelie巧算法得到的特征对于每个能耗指标的特征属性权重 排序图;
[0062] 图(2a)为固体能耗权重排序图;图姊)为煤气能耗权重排序图。
【具体实施方式】
[0063] 下面结合附图和具体实施例对本发明进行详细说明。本实施例W本发明技术方案 为前提进行实施,给出了详细的实施方式和具体的操作过程,但本发明的保护范围不限于 下述的实施例。
[0064] 如图1所示,本发明实施例提供一种基于集成模型的烧结能耗预测方法,该方法 包括W下步骤:
[0065] 步骤1),基于RRelie巧的特征选择算法进行模型特征选择。
[0066] 在烧结过程中能耗的影响因素众多,可W归纳为;1)配料参数、2)状态参数、3)操 作参数=类。配料参数主要包括主料和辅料添加量W及介质消耗,该些参数在烧结开始前 就W确定;状态参数主要包括风箱温度、压力,点火空煤气流量等生产状态值,它们由现场 传感器获取;操作参数包括烧结现场可人工调节的参数,如台车速度、料层厚度、混合机加 水量等,它们在烧结开始时由操作人员确定。通过对烧结过程的分析,将烧结能耗影响因素 总结如表1所示。
[0067] 表1烧结能耗影响因素分析
[0068]
[0069]
[0070] 影响烧结能耗的因素多种多样,该些因素重要程度的高低仅凭机理分析和人工经 验难W确定,需要通过数据分析获得更加客观合理的结论。
[0071] 本发明采用一种改进的Relief算法(RRelie巧算法)进行模型特征选择。Relief 系列算法是一种典型的根据权重选择特征的随机捜索方法,其主要思想是;根据特征对近 距离样本的区分能力来评估特征,好的特征应该使同类样本接近,而使不同类的样本远离。
[0072]RRelie巧算法则用于处理目标属性为连续值的回归问题,
[0073]RRelie巧算法进行模型特征选择的具体过程如下:
[0074]SteplOl;从规模为m的样本集中选出某个样本町,从剩余的m-1个样本中选出离 该样本Di距离最近的k。。"个样本,其中1《i《m,k。。"的值一般取10~20为宜。所述距 离指欧氏距离。
[00巧]Stepl02 ;迭代计算在所述样本Di输出指标取值P。条件下的权重集ndc;
[0076]
[0077] 其中,P康示所述样本Di的输出指标P的取值,Pi(1《i《k"eJ是所述k"ear个样 本中第i个样本的输出指标值,Pm。济pmi。分别是m个样本中输出指标的最大值和最小值;
[0078]计算在所述样本Di输入特征A条件下的权重集ndA[A],按下式进行迭代计算:
[0079]
[0080]其中,A。表示所属样本Di的输入特征A的取值,Ai(1《i《k"eJ是所述k"ear个 样本中第i个样本内输入特征A的取值,Am。济Ami。分别是m个样本中输入特征A的最大值 和最小值;
[0081] 计算在所述样本Di输出指标取值P。和输入特征A条件下的权重集nde&dA[A];
[0082]
[0083] Stepl03 ;对样本集中的每个样本依次执行SteplOl~102,共循环m次,得到m个 ndc、ndA[A]和ndcMA[A],那么
[0084] St巧104 ;计算输入特征A的权重值W[A];
[0085]
[0086] St巧105 ;根据权重选择模型特征。
[0087]步骤2),根据所选模型特征的历史数据,建立改进极限学习机智能预测模型和回 归型支持向量机智能预测模型。
[0088] 在获得影响烧结能耗重要特征的基础上,采用基于bagging的改进ELM(极限 学习机,ExtremeLearningMachine)算法提高原ELM算法的稳定性和泛化能力,采用 e-SVR(回归型支持向量机)算法在小样本条件下提高泛化性能。
[0089] (1)基于Bagging的改进ELM烧结能耗预测模型B-ELM的建模过程如下;
[0090] Stepal;确定子学习机的个数M。
[0091] Stepa2 ;确定子学习机训练数据集。通过数据清理和特征提取获得bagging数据 集:^ = ^((乂,.,_7,£^1,每个知。71)都有11个输入和1个输出,即义£护,7£尺。选择2/3作为 训练数据集B,其余作为测试数据集C。
[0092] 用Bootstrap方法从训练数据集B中有放回抽样,得到每个子学习机的训练数据 集Bk,k= 1,…,M,且Bk与B规模相同,都为N,令k= 1。
[009引 Stepa3;用Bk训练相应的子学习机,得到训练结果,并用统一的测试数据集C检验 预测精度,k=k+1。
[0094] 设K为隐层节点个数,随机获取初始输入权值Wi和偏置b1,1 = 1,…,K。计算隐 层输出矩阵H化。il(n= 1,…,N,1 = 1,…,K)。求出H的广义逆矩阵H+,根据0 =H+T计 算输出权值0。
[0095] Stepa4 ;判断k是否满足k《M,若是,则返回步骤Stepa3,若否,则用平均法对所 有子学习机训练结果进行集成,得到最终结果,并验证模型精度。
[0096] (2)基于e-SVR烧结能耗预测建模的过程如下:
[0097] Stepbl;对原始数据进行归一化处理;
[0098]
[0099] 其中,Qp为各因素的第P个值,P= 1,…,N,Qm"、Qmi。分别为各因素中的最大值和 最小值,a、d为参数,d= (1-a) /2 ;
[0100] 本实施例中,将原始数据规范到化2, 0. 8]区间,a= 0. 6。
[010。Stepb2 ;确定SVR模型的参数并训练网络。本模型采用RBF核函数,惩罚因子C和RBF核函数中的方差g通过交叉验证法获得。具体步骤是将C和g分别设置为-10~10之 间W0. 01为步长进行变化,在不同的C和g的组合下分别计算SVR模型的精度,找到最优 的C和g组合值,W此作为SVR模型的参数逐一训练网络。
[0102] Stepb3 ;用测试数据集C测试网络的精度,得到网络预测输出值,然后进行反归一 化:
[0103]
[0104] 其中,JV为第q个测试样本的网络输出值,L为测试数据集样本个数,衣/为第q个 测试样本反归一化后的预测值,q= 1,2, . . .,L。
[0105] Stepb4 ;对SVR模型进行性能评价,评价公式:
[0106]
[0107] 其中,MeanRe表示平均相对误差,y,(q= 1,2, . . .,L)为第q个测试样本的真实值。
[010引步骤3),对多个单一智能预测模型进行加权集成,获得集成后的烧结能耗预测值。
[0109] 在建立了烧结能耗的B-ELM和e-SVR模型后,采用滴权法对上述子模型进行加权 集成,W精确预测烧结能耗。基于信息滴的集成预测模型具体流程为:
[0110] Step301 ;计算各智能预测模型所获得的预测结果的变异程度:
[0111]
[0112] 其中,e。。、表示第U个模型第q个样本的相对误差值和预测输出值,y。表示第 q个样本期望输出,q= 1,2,...,LL为测试数据集样本个数,U= 1,2,分别代表B-ELM和e-SVR模型。
[0113] St巧302 ;计算各智能预测模型的滴值:
[0114]
[0115] 其中,Pud为第q个样本的第U个模型的预测相对误差比值,
[0116] St巧303 ;计算各智能预测模型的权值:
[0117]
[om] 其中,Zu表示第U个模型的权值。
[0119] St巧304 ;计算各模型的加权集成输出;
[0120]
[0121] W某年产650万吨钢规模的钢铁联合企业为例,其2X380m2规模烧结生产线年产 成品烧结矿836万吨,作业率94%,利用系数为1.40t/m2 -h。选取2010年1~12月的 311组烧结生产历史数据进行分析建模。每组样本包含固体能耗和煤气能耗两个能耗指标 和73个特征,特征属性如表1所示,其中配料参数12个,状态参数50个,操作参数11个。 在进行数据清理的基础上,基于RReliefF算法得到特征对于每个能耗指标的权重排序,如 图2所示。
[0122] 对于固体能耗,排在前5位的特征分别是;焦粉加入量、云粉加入量、物料流量 PD-1、点火温度T3、混匀矿加入量;对于煤气燃耗,排在前5位的特征分别是:点火温度T3、 总管空气压力、混匀矿加入量、物料流量PD-1、焦粉加入量。可W看出该些特征排序与实际 情况基本符合。
[0123] 为验证和比较模型精度和性能,本实施例选取W下4个评价指标:
[0124] 1)平均相对误差MeanRe;
[0133] 为了全面验证所提出的集成模型的有效性,首先在没有进行特征选择的情况下, 将本模型的预测结果与ELM,B-ELM,e-SVRS种模型进行比较,如表2和表3所示。经过特 征选择后的模型精度比较如表4和表5所示。需要说明的是,对于每一个单一算法(子) 模型,都通过交叉验证法确定最优模型参数;同时,每种模型都运行5次,取每个指标的平 均值作为最终结果。Bagging子模型个数设为10,特征因素保留个数设为30。
[0134] 由表2和表3可知,本发明提出的基于信息滴的集成预测模型的平均相对误差要 优于其他四种模型,其他指标也显示出了不同程度的优势,从而验证了本发明所建立模型 的优越性。该里,由于集成模型是2个子模型的归一化加权和,故其最大误差介于子模型的 最大误差之间是合理的。由表4和表5可知,特征选择后的模型精度较表2和表3都有较 大幅度提高,从而验证了本发明中特征选择方法的有效性。
[013引此外,由于ELM和e-SVR都具有无需调整网络权值,训练速度快的优点;RReliefF算法作为一种启发式算法,同样具有时间效率高的特点,故本发明提出的集成模型具有良 好的时间效率。如表6所示,集成预测模型总耗时约88s。
[0136] 表2无特征选择的固体能耗预测指标比较
[0137]
[0147] 综上所述,本发明提出的基于信息滴的集成预测模型具有良好的预测精度和泛化 能力,同时具有较高时间效率,在实际生产具有应用推广价值。
【主权项】
1. 一种基于集成模型的烧结能耗预测方法,其特征在于,该方法包括以下步骤: 1) 基于RReliefF的特征选择算法进行模型特征选择; 2) 根据所选模型特征的历史数据,建立改进极限学习机智能预测模型和回归型支持向 量机智能预测模型; 3) 对多个单一智能预测模型进行加权集成,获得集成后的烧结能耗预测值。2. 根据权利要求1所述的基于集成模型的烧结能耗预测方法,其特征在于,所述步骤 1)具体为: SteplOl :参数初始化,令i = 1,j = 1 ; Stepl02 :在规模为m的样本空间S中选择样本Di,从剩余的m-1个样本中选出离该样 本Di距离最近的k 个样本,组成近邻样本集S k; Stepl03 :从Sk中选择样本D」,计算不同预测值下的权重Ndiff,: NdiffT = Ndiffτ+(???(τ (· ^DilDjVknear 其中,τ (·)为样本的预测值; StepKM :对每个特征属性Α,计算不同特征属性的权重Ndim以及不同预测值与不同特 征属性的权重 Ndiff τ &diffA: NdiffA= N diffA+diff (A, Di, Dj) /knear Ndiff τ MiffA - N diff TMiffA+diff(了( ·),Di, Dj) · diff(A,Di, Dj)/knear Stepl05 :令i = i+1,j = j+1,判断j是否满足j彡knear,若是,则返回Stepl03,若否, 则执行Stepl06 ; Stepl06 :判断i是否满足i彡m,若是,则返回SteplOl,若否,则执行Stepl07 ; Stepl07 :对于每个属性A,计算每个特征属性的最终权重估计: W [A] - Ndiff τ MiffA/Ndiff τ_ (Ndiff τ -Ndiff τ MiffA) / (m-Ndiff τ) 最后根据权重选择模型的特征属性。3. 根据权利要求2所述的基于集成模型的烧结能耗预测方法,其特征在于,所述k 的值为10~20。4. 根据权利要求1所述的基于集成模型的烧结能耗预测方法,其特征在于,所述改进 极限学习机智能预测模型的建立过程为: Stepal :确定子学习机的个数M ; St印a2 :用Bootstrap方法从训练数据集B中有放回抽样,得到每个子学习机的训练数 据集Bk,k = 1,···,Μ,且Bk与B规模相同,都为N; Stepa3 :依次用Bk训练相应的子学习机,得到M个训练结果,并分别用统一的测试数据 集C检验预测精度; St印a4 :用平均法对所有子学习机训练结果进行集成,得到最终结果,并验证模型精 度。5. 根据权利要求1所述的基于集成模型的烧结能耗预测方法,其特征在于,所述回归 型支持向量机智能预测模型的建立过程为: Stepbl :对原始数据进行归一化处理:其中,Qp为各因素的第P个值,P = 1,"·,Ν,Qniaj^Qniin分别为各因素中的最大值和最小 值,a、d 为参数,d = (l_a) /2 ; St印b2 :采用RBF核函数,确定SVR模型的参数并训练网络; Stepb3 :用测试数据集C测试网络的精度,得到网络预测输出值,然后进行反归一化: y,, = (Qlmx - Qmin )y<, + Qmin 其中,久为第q个测试样本的网络输出值,L为测试数据集样本个数,Λ为第Q个测试 样本反归一化后的预测值,q = 1,2, . . .,L ; Stepb4 :对SVR模型进行性能评价。6.根据权利要求1所述的基于集成模型的烧结能耗预测方法,其特征在于,所述步骤 3)中,采用信息熵对多个单一智能预测模型进行加权集成,具体为: Step301 :计算各智能预测模型所获得的预测结果的变异程度:其中,%、尺表示第u个模型第q个样本的相对误差值和预测输出值,y,表示第q个 样本期望输出,q = 1,2, ...,L,L为测试数据集样本个数,u = 1,2,分别代表改进极限学习 机智能预测模型和回归型支持向量机智能预测模型; Step302 :计算各智能预测模型的j:商值:其中,Pud为第q个样本的第u个模型的预测相对误差比值,Step303 :计算各智能预测模型的权值:其中,Zu表示第u个模型的权值; Step304 :计算各模型的加权集成输出: 〇
【专利摘要】本发明涉及一种基于集成模型的烧结能耗预测方法,该方法包括以下步骤:1)基于RReliefF的特征选择算法进行模型特征选择;2)根据所选模型特征的历史数据,建立改进极限学习机智能预测模型和回归型支持向量机智能预测模型;3)对多个单一智能预测模型进行加权集成,获得集成后的烧结能耗预测值。与现有技术相比,本发明基于信息熵的集成预测模型具有良好的预测精度和泛化能力,同时具有较高时间效率,在实际生产具有应用推广价值。
【IPC分类】G06Q10/04
【公开号】CN104881707
【申请号】CN201510225409
【发明人】乔非, 马玉敏, 王俊凯, 卢凯璐, 李国臣
【申请人】同济大学
【公开日】2015年9月2日
【申请日】2015年5月4日
转载请注明原文地址:https://www.famiwei.com/read-8138369.html

最新回复(0)