一种提高大气污染模型预测效率的方法

xiaoxiao2020-10-23  12

一种提高大气污染模型预测效率的方法
【技术领域】
[0001] 本发明设及突发性事故的安全与应急处理技术领域,特别是设及大气污染扩散技 术领域,具体为一种提高大气污染模型预测效率的方法。
【背景技术】
[0002] 随着经济的发展,工业污染源对大气环境的影响越来越大,造成了严重的环境破 坏,对人民的生活环境带来了严重的威胁。然而,对工业现场污染进行实时的动态监测、预 测又有很大的困难,不是十分的可行,因此,通过大气污染扩散模型来模拟预测大气污染的 扩散应用的很普遍。大气扩散模型是一种时空复合的环境模型,用于描述大气对污染物的 输移、扩散和稀释作用,它是进行环境评价和环境预测的有力手段,是评估泄漏危险度和可 能泄漏量、分析有毒化学物质大气泄漏事故环境影响的最佳方法。近地大气扩散模拟自20 世纪30年代前后就得到发展,至今已发展为数众多的大气扩散模型。
[0003] 从2009年4月1日起,我国的现行法规模式包括估算模式,AERMOD,ADMSW及 CALPUFF模式。20世纪90年代中后期,美国气象学会联合美国环境保护局组建法规模型改 善委员会基于最新的大气边界层和大气扩散理论,成功的开发了AERMOD大气扩散模型,W 一代新的法规模型替代了原本的ISC模型。AERMOD模型是稳态烟羽模型,评价范围为50km W内,W扩散统计理论为出发点,假设污染物的浓度分布在一定程度上服从高斯分布。该模 型由S大部分组成;AERMET模块(气象数据预处理器)、AERMAP模块(地形数据预处理器) W及核屯、模块AERMOD(扩散模型)。模式系统可用于多种排放源(包括点源、面源和体源) 的排放,也适用于乡村环境和城市环境、平坦地形和复杂地形、地面源和高架源等多种排放 扩散情形的模拟和预测。其中,该模型适用范围一般为50kmW内,并且使用中的地形高程 范围必须要大于所选取的评测区域的范围。模型的不足在于;实际中所取DEM高程数据的 评测区域范围与污染造成的实际区域(或者实际的评测区域)相比过大,导致了较大的计 算量,降低了计算效率。在此之前,凡设及污染扩散预测方面对模型的应用均严格按照原始 模型的设计进行预测应用,至于评测区域的选取并没有明确的依据。目前国内外在林火、降 雨的预测方面,根据大量的气象数据,运用机器学习中的非线性回归和支持向量机技术,获 得预测模型,取得过不错效果。本专利着眼于:模型本身没有根据历史数据事先通过预测来 选取地形高程DEM数据范围选取的功能,因此本专利的创新之处也就在于在原始模型的基 础上,受到相关预测方法的启发,运用机器学习当中的多元多项式回归方法,通过大量气象 数据训练,建立选取评测区域大小的多元多项式模型,改善W往对评测区域选择依据不明 确的弊端,提高模型的预测计算效率。
[0004] 我国常用大气扩散模型AERMOD原理简介;AERMET的边界层参数数据和廓线数 据可W由输入的现场观测数据确定,或由输入的国家气象局常规气象资料(地面数据、探 空数据)生成。AERMET廓线数据和边界层廓线数据经过AERMOD中的控制文件引用进入 AERMOD系统,计算出相似参数,并对边界层廓线数据进行内插。AERMOD将平均风速、水平 向及垂向端流量脉动、温度梯度、位温、水平拉格朗日时间尺度等输入扩散模式,并计算出 AERMAP是简化并标准化AERMOD地形输入数据的地形预处理器,它将输入的各网格点的位 置参数(X,y,Z)及其地形高度参数(xt,yt,zt)经过计算转化成AERM0D数据处理的地形数 据,包括有各个网格点位置参数(x,y,z)及其有效高度值,该些数据用于障碍物周围大气 扩散的计算并结合风速U等参数的分布,从而可W进行污染物浓度的分布计算。AERMOD的 浓度预测计算。
[0005] 1)平坦地形条件(即不考虑地形影响)
[0006]
[0007] 式中;Q为污染源排放速率,U为有效风速,Py,Py为水平方向和垂直方向浓度分布 的概率密度函数。
[000引 2)考虑地形条件:
[0009] Cr(X,y,Z) =f.C(X"y"Zr) + (1-f).C(X"y"Zp)
[0010] 式中;C(Xr,y,,Zr)为水平烟羽的贡献,C(Xr,y,,Zp)为地形影响的烟羽贡献。
[0011] 扣对流边界层内的浓度预测计算
[0012] 对流边界层中预测的地面浓度由W下=种污染源的浓度组成:
[0013] 第一部分;因下沉气流直接扩散到地面的直接源:
[0016] 第二部分;因上升气流扩散到混合层顶的间接源:
[0017]
[0018] 第=部分;穿透进入混合层上部稳定层中的烟羽,经过一段时间后还将重新进入 混合层,并扩散到地面,也就是穿透源:
[0019]
[0020] W上式中,Fy为水平分布函数,0y为水平扩散参数,Zi为混合层高度,0d为直接 源垂直扩散参数,0 为穿透源垂直扩散参数,W为直接源烟羽总高度,tj.为间接源烟 羽总高度,Aj.是上升和下沉两部分烟羽的权重系数,m为反射次数,h为穿透源高度,Z 为稳定层中反射面高度。
[0021] 4)稳定边界层内的浓度预测计算
[0022] 平坦地形上,适用于稳定条件AERMOD浓度表达式的形式为高斯模型:
[0023]

[0026] 式中;hp为烟羽高度,Ha为垂直混合极限高度,Hp为排放源高度与烟羽抬升高度之 和,Fy为曲流的水平分布函数。
[0027] 大气扩散模型AERMOD在实际应用中都是在模型的有效范围之内尽量大的选取 DEM地形高程范围所包含的评测区域进行网格划分,W达到包含实际污染事故的影响范围 的目的,然后在该评测区域上进行网格划分,由于选取的评测区域往往比实际污染范围要 大,该样就使得在实际污染范围之外的网格点也参与了AERMOD模型的计算过程当中,该样 做无疑增加了在所选取的评测区域范围内实际并没有被影响的区域的计算量的问题,增加 了不必要的计算,降低了模型的预测效率。

【发明内容】

[002引鉴于W上所述现有技术的缺点,本发明的目的在于提供一种提高大气污染模型预 测效率的方法,用于解决现有技术中大气污染模型计算量大而且预测效率低的问题。
[0029] 为实现上述目的及其他相关目的,本发明提供一种提高大气污染模型预测效率的 方法,应用于通过大气污染模型评测污染区域的过程中,所述方法包括;对原始气象数据进 行预处理获取边界层参数数据和廓线数据,根据所述边界层参数数据、所述廓线数据、污染 源参数W及地形数据获取大气污染模型内各个预测网格点的污染浓度值,根据所述污染浓 度值获取关注污染物浓度的等值线并根据所述等值线获取污染影响面积;利用所述边界层 参数数据、所述廓线数据W及所述污染影响面积建立具有预测作用的多项式预测模型;W 存在大气污染时的实时气象数据为输入,根据所述多项式预测模型获取预测污染面积,将 所述预测污染面积和污染源的位置信息导入到大气污染模型中作为选取所述大气污染模 型中评测污染区域的依据。
[0030] 优选地,通过对所述各个预测网格点的污染浓度值进行插值运算获取所述关注污 染物浓度的等值线。
[0031] 优选地,所述获取污染影响面积具体为;获取所述等值线中最远两点之间的距离, W所述距离为边长构建涵盖所述等值线在内的正方形,获取所述正方形的面积并W所述正 方形的面积作为所述污染影响面积。
[0032] 优选地,所述等值线至少为两条。
[0033] 优选地,利用所述边界层参数数据、所述廓线数据W及所述污染影响面积建立具 有预测作用的多项式预测模型具体为;W所述边界层参数数据和所述廓线数据为训练数 据,W所述污染影响面积为因变量数据,经过对所述训练数据的多次训练获得多项式模型, 再根据均方误差和拟合优度对所述多项式模型进行优化获得所述具有预测作用的多项式 预测模型。
[0034] 优选地,所述具有预测作用的多项式预测模型为:
[003引 f(X。&,X3. . .X。)= 0 0又1。+P1又2。+. . . + 00。又1。-1又2. . .Xm;
[0036] 其中,X。X,,X3...Xm分别为边界层参数数据和廓线数据的主分量参数构成的多项 式预测模型的训练输入数据;0。,01... 0。_1,0。分别为多项式预测模型中训练输入数据 的系数;n为模型训练输入参数的个数;m为组合项参数的个数。
[0037] 优选地,根据均方误差和拟合优度对所述多项式模型进行优化具体为:获取模型 预测面积的均方误差的和W及拟合优度之后,利用梯度下降法获取代价函数在最小值时多 项式预测模型中系数的值。
[003引优选地,所述模型预测面积的均方误差的和为
其中,Si为 模型对面积的预测值,Sd为包含等值线的正方形的真实值,n为样本数,i为样本中的 第i个样本;所述拟合优度为:
其中,r2为所建模型对问题 拟合的拟合优度,Si为模型对面积的预测值,5为模型预测面积的平均值,Xi为边界层 参数数据和廓线数据的主分量参数构成的多项式预测模型的训练输入数据;X为Xi的平 均值;所述代价函数为:
其中,0。,01...为多项式预 测模型中训练输入数据的系数,r2为所建模型对问题拟合的拟合优度,SW为第i个样本 的面积真实值,f0(W)为第i个样本的模型对面积的预测值;梯度下降法采用的公式为;
I其中,a为学习率,为多项式预测模型训练输入数据的系数 系数,0。,01...为多项式预测模型中训练输入数据的系数。
[0039] 如上所述,本发明的一种提高大气污染模型预测效率的方法,具有W下有益效 果:
[0040] 1、本发明与大气扩散模型AERMO相结合,提出了优化选取进行网格划分的评测区 域的方法,减少了不必要的网格点的计算消耗,提高了预测效率。
[0041] 2、本发明提出的方法具有可预测性,可根据事故发生前的真实气象数据进行合理 的预测,降低了了W往AERMOD模型选取评测区域的盲目性。
[0042] 3、本发明提出的方法具有较好的适用性,在实际污染扩散事故当中对应急救援能 起到很好的实际场景中参考作用,降低事故中人力物力的浪费。
【附图说明】
[0043] 图1显示为本发明的一种提高大气污染模型预测效率的方法的流程示意图。
[0044] 图2显示为本发明的一种提高大气污染模型预测效率的方法中原始大气扩散模 型AERMOD模型的原理图。
[0045] 图3显示为本发明的一种提高大气污染模型预测效率的方法中选取新的评测区 域的示意图。
[0046] 图4显示为本发明的一种提高大气污染模型预测效率的方法对原始AERMOD模型 进行优化的算法流程图。
【具体实施方式】
[0047]W下通过特定的具体实例说明本发明的实施方式,本领域技术人员可由本说明书 所揭露的内容轻易地了解本发明的其他优点与功效。本发明还可W通过另外不同的具体实 施方式加W实施或应用,本说明书中的各项细节也可W基于不同观点与应用,在没有背离 本发明的精神下进行各种修饰或改变。
[0048]本发明的目的在于提供一种提高大气污染模型预测效率的方法,用于解决现有技 术中、大气污染模型计算量大而且预测效率低的问题。W下将详细描述本发明的一种提高 大气污染模型预测效率的方法的原理和实施方式,使本领域技术人员不需要创造性劳动即 可理解本发明的一种提高大气污染模型预测效率的方法。
[0049]本发明在于提出一种选取较为接近实际情况切包含实际事故影响范围的评测区 域的方法,在此评测区域上进行网格划分,减少实际未被事故影响区域中网格点的计算,提 高模型的预测效率。
[0化0] 具体地,在本实施例中,如图1所示,本实施例提供一种提高大气污染模型预测效 率的方法,应用于通过大气污染模型评测污染区域的过程中,所述方法包括W下步骤。
[0化1 ] 步骤S11,对原始气象数据进行预处理获取边界层参数数据和廓线数据,根据所述 边界层参数数据、所述廓线数据、污染源参数W及地形数据获取大气污染模型内各个预测 网格点的污染浓度值,根据所述污染浓度值获取关注污染物浓度的等值线并根据所述等值 线获取污染影响面积。在本实施例中,大气扩散模型采用AERMOD大气扩散模型,具体可通 过对所述各个预测网格点的污染浓度值进行插值运算获取所述关注污染物浓度的等值线, 所述等值线至少为两条。
[0化2] 在本实施例中,所述获取污染影响面积具体为;获取所述等值线中最远两点之间 的距离,W所述距离为边长构建涵盖所述等值线在内的正方形,获取所述正方形的面积并 W所述正方形的面积作为所述污染影响面积。
[0053]步骤S12,利用所述边界层参数数据、所述廓线数据W及所述污染影响面积建立具 有预测作用的多项式预测模型。
[0054]具体地,在本实施例中,利用所述边界层参数数据、所述廓线数据W及所述污染影 响面积建立具有预测作用的多项式预测模型具体为;W所述边界层参数数据和所述廓线数 据为训练数据,W所述污染影响面积为因变量数据,经过对所述训练数据的多次训练获得 多项式模型,再根据均方误差和拟合优度对所述多项式模型进行优化获得所述具有预测作 用的多项式预测模型。
[0化5]具体地,在本实施例中,所述具有预测作用的多项式预测模型为:
[0056]f(X。X2,X3. . .X。)= 0 此。+ 0 雨。+. . . + 0。-而。+ 0 品。-1又2. . .Xm;其中,X1,X2,X3. . .X。 分别为边界层参数数据和廓线数据经过PCA分析后的主分量参数(即多项式预测模型的训 练输入数据);0。,01... 0。_1,0。分别为模型中训练输入数据的系数;n为模型训练输入 参数的个数;m为组合项个数。
[0化7]根据均方误差和拟合优度对所述多项式模型进行优化具体为;获取模型预测面积 的均方误差的和W及拟合优度之后,利用梯度下降法获取代价函数在最小值时多项式预测 模型中系数的值。
[0化引其中,所述模型预测面积的均方误差的和为
其中,Si为模 型对面积的预测值,Sd为包含等值线的正方形的真实值,n为样本数,i为样本中的第i个 样本;所述拟合优度为:
其中,r2为所建模型对问题拟合的拟 合优度,Si为模型对面积的预测值,玄:为模型预测面积的平均值,Xi为边界层参数数据和 廓线数据经过PCA分析后的主分量参数构成的多项式预测模型的训练输入数据;三为Xi的 平均值;所述代价函数为:
其中,0。,01...为多项式预 测模型中训练输入数据的系数,r2为所建模型对问题拟合的拟合优度,SW为第i个样本 的面积真实值,f0(W)为第i个样本的模型对面积的预测值;梯度下降法采用的公式为;
'其中,a为学习率,为多项式预测模型训练输入数据的系数 系数,0。,01...为多项式预测模型中训练输入数据的系数。
[0化9] 步骤S13,W存在大气污染时的实时气象数据为输入,根据所述多项式预测模型获 取预测污染面积,将所述预测污染面积和污染源的位置信息导入到大气污染模型中作为选 取所述大气污染模型中评测污染区域的依据。
[0060] W下对上述步骤进行进一步详细说明。
[006U 如图2所示为原始AERMOD模型的示意图,利用原始的AERMOD模型,根据历史气象 数据获得各个预测网格点的污染浓度值,然后对各个格点的浓度值进行插值,获得应急现 场关注的伤害浓度的等值线,再利用算法得出等值线中最远两点之间的距离,W此距离为 边长作包含该等值线的正方形,获得其面积值,如图3示意。
[0062] 具体为:原始地面气象数据和探空气象数据经过AERMOD模型中的气象预处理模 块AERMET处理,获得AERMOD核屯、模块所需要的综合气象数据 ;边界层参数数据和廓线数 据;在AERMAP模块中设置好地形高程数据文件和按照原始模型的要求选取评测区域进行 网格划分,结合现场实际场景W及污染源的参数,经过AERMAP地形预处理后与AERMET模块 的输出一并输入到AERMOD核屯、模块当中,计算出在AERMAP中划分好的各个网格点的污染 物的浓度值;然后经过插值算法的插值获得特定浓度的等值线,再利用算法得出等值线中 最远两点之间的距离1,W此距离al(0 <a< 0. 5)为边长作包含该等值线的正方形4,获 得其面积值S=al*al。
[0063] 由于污染造成的实际影响范围的大小对选取在其上进行网格划分的评测区域具 有最直观的参考作用,又考虑到应急场景的及时性,因此,利用上述的边界层参数数据和廓 线数据,在与之对应的特定等值线面积之间,建立起具有预测作用的预测模型,具体为:利 用机器学习中多元多项式的回归思想,W边界层参数数据和廓线数据为训练数据,与之对 应的特定等值线面积为因变量数据,经过大量数据的训练获得多项式的模型,再用测试数 据结合均方误差、拟合优度等指标进行算法模型的测试和优化矫正,获得性能较好的算法 模型。
[0064] W上述获得的多项式模型为预测模型,应用在应急场景中为;W现场实时的气象 数据为输入,获得预测面积,结合污染源的位置信息等转换为具体的经绅度范围,W此范围 导入AERMAP模块当中,作为选取AERMOD模型中评测区域的依据。该样一来,在实际模型的 预测应用中,评测区域的将尽可能的接近实际污染事故的影响区域,减少了不必要的网格 点的计算,提高了预测效率。
[0065] 如图4的算法模型的流程图所示,本专利中提到的方法的实施过程大体上分为= 个部分:
[0066] 1)根据气象数据,经由AERMOD模型W及后续处理获得污染影响面积;利用原始的 AERMOD模型,如图2所示,通过AERMET模块对原始气象数据进行预处理获得符合AERMOD 模块需要的综合气象指标W及特定的格式;在地形预处理模块中有一部分是包含事故实 际污染区域的评测区域,另一部分是包含评测区域的地形高程DEM数据区域。评测区域用 来在其上进行网格划分,也即相当于在该个区域上进行污染事故的预测,经过AERMAP的处 理,输入到AERMOD模块当中,最终计算出每个格点的污染物的浓度值,然后对各个格点的 浓度值进行插值,获得应急现场关注的伤害浓度的等值线,再利用算法得出等值线中最远 两点之间的距离,W此距离为边长作包含该等值线的正方形,获得其面积值,如图3示意, 并且有;由于面相应急救援,我们假设方法中的预测为短时预测(即某时刻到该时刻前2小 时);假设事故源0在途中坐标原点处,横轴为风向的方向,预测的污染范围在事故源的下 风向,纵向按纵向扩散理论考虑。
[0067] 具体步骤为;
[0068] (1)统计长期的地面气象数据参数(.0QA文件)和探孔气象数据文件(.IQA文 件),按每天8时、12时、16时、20时、24时、4时的气象数据作为AERMOD模型中AERMET气 象数据预处理模块的输入,如图1所示的AERMOD模型中的AERMET气象预处理模块。
[0069] (2)获得AERMET模块的输出文件;边界层参数数据文件和廓线数据文件。
[0070] (3)在AERMAP中设置好地形高程信息、污染源点信息和网格划分的评测区域(接 收点)信息,输出供AERMOD模块使用的地形数据和接收点数据。
[007U (4)把上述的边界层参数数据和廓线数据文件,结合污染源0的实际参数、AERMAP地形数据预处理模块的输出文件作为AERMOD模块的输入文件,经过核屯、模块的计算,获得 AERMAP中各个格点的污染扩散的浓度C;其中在AERMOD模块中网格点浓度值的计算可依据 具体的场景,结合W下的算法公式进行计算:
[0076]
[0081] W上各参数含义均可在技术背景中得知。
[0082] (5)对上述获得的各个格点的浓度数据进行合理的插值计算,绘制=条关注的浓 度(如二氧化硫)的等值线1,2, 3(Ci< C 2< C 3),如图2中S条不同浓度Ci,C2, C3的等值 线不眉、。
[0083] (6)计算上述=条浓度等值线中最外层等值线(浓度为Cl)上距离最远的两点之 间的距离1,Wal(a为系数,取值范围为0 <a< 0. 5,)作为图中正方形4的边长,作包含 该等值线的正方形,面积为S=al*al。
[0084] 2)W边界层数据和廓线数据经过PCA主分量分析后的为训练数据(自变量),对 应的包含特定浓度等值线的正方形面积为因变量,运用机器学习中多元多项式的回归思 想,建立起预测模型;由于污染造成的实际影响范围的大小对选取在其上进行网格划分的 评测区域具有最直观的参考作用,又考虑到应急场景的及时性,因此,利用上述的边界层参 数数据和廓线数据,在与之对应的特定等值线面积之间,建立起具有预测作用的预测模型, 具体为;利用机器学习中多元多项式的回归思想,W边界层参数数据和廓线数据为训练数 据,与之对应的特定等值线面积为因变量数据,经过大量数据的训练获得多项式的模型,再 用测试数据结合均方误差、拟合优度等指标进行算法模型的测试和优化矫正,获得性能较 好的算法模型。具体步骤为:
[0085] ①对AERMET输出的边界层数据和廓线数据Z进行PCA主成分分析,选取前m个主 成分(表达信息量(即累计贡献率)大于85%)X,也就是作为本专利方法的直接作用输入 训练参数,面积S作为因变量。
[0086]21=狂1-1〇/5。,4为2斯均值,5。为21的标准差,则第1个主成分为: [0087]Xi=e/X,其中e;为第i个特征向量;
[008引第i个主成分的贡献率为:
[0089]
[0090] ②鉴于多元多项式能描述较为复杂的非线性问题,本专利选取用多远多项式,借 助于机器学习中多项式回归的思想,通过处理后的特征因子X训练出能描述该问题的多元 多项式的模型,形如:
[0091 ] f(X。X2,X3. . .X。)= 0 此。+P雨。+. . . + 0。-而。+ 0 . .Xn+...
[0092] ⑨用大量的训练数据对上述模型进行训练,利用梯度下降法通过使代价函数最小 确定模型中变量前的系数,确定模型;
[0093] 指柄:
[0094] 均方误差和:
其中Si为预测值,S为真实值;
[009引④再通过测试数据对上述模型进行测试,进行多次试验,依据指标选取合适模型, 剔除噪声点,再重复上述的训练过程,W验证模型的可用性。
[0099] 3)W现场获得的边界层参数数据和廓线数据为输入,通过上述建立的预测模型 f狂),得出预测面积S,作为AERMAP中评测区域的选取依据:W上述获得的多项式模型为 预测模型f狂),应用在应急场景中为;W现场实时的边界层参数气象数据和廓线数据为 输入,获得预测面积S,结合污染源的位置信息等转换为具体的经绅度范围,W此范围导入 AERMAP模块当中,作为选取AERMOD模型中评测区域的依据。
[0100] 由于面相应急救援,我们假设方法中的预测为短时预测(即某时刻到该时刻前2 小时);假设事故源0在附图3中坐标原点处,横轴为风向的方向,预测的污染范围考虑在 事故源的下风向,纵向按纵向扩散理论考虑。本专利结合大气扩散模型AERMOD,提出利用气 象数据和由此产生的污染范围的面积大小,建立由气象数据为驱动因素、污染范围面积为 结果变量的预测模型,利用该模型通过新的预测数据来预测出对应的污染面积,W此面积 作为AERMAP模块中进行网格划分的评测区域的选择依据,降低W往选择的盲目性,提高模 型的预测效率。具体步奏如下所述:
[0101] 1.统计长期的地面气象数据参数(.OQA文件)和探孔气象数据文件(.IQA文件), 按每天8时、12时 、16时、20时、24时、4时的气象数据作为AERMOD模型中AERMET气象数据 预处理模块的输入。
[0102] 2.获得AERMET模块的输出文件;边界层参数数据文件和廓线数据文件。
[0103] 3.把上述的边界层参数数据和廓线数据文件,结合污染源0的实际参数、AERMAP 地形数据预处理模块的输出文件作为AERMOD模块的输入文件,经过核屯、模块的计算,获得 AERMAP中各个格点的污染扩散的浓度。
[0104] 4.对上述获得的各个格点的浓度数据进行合理的插值计算,绘制S条关注的浓度 (如二氧化硫)的等值线1,2, 3(Ci< C 2< C 3)。
[01化]5.计算上述S条浓度等值线中最外层等值线(Cl)上距离最远的两点之间的距离 1,Wal(0 <a< 0. 5)为边长,作包含该等值线的正方形,面积为S=al相1。
[0106] 6.对AERMET输出的边界层数据和廓线数据X进行PCA主成分分析,选取前m个主 成分(表达信息量(即累计贡献率)大于85%)Z,也就是作为本专利方法的直接作用输入 训练参数,面积S作为因变量。
[0107]Zi=狂i-y1)/S。,yi为Zi的均值,5U为Zi的标准差,则第i个主成分为;
[010引 Xi=eX,其中e;为第i个特征向量;
[0109] 第i个主成分的贡献率为;
[0110]
[0111] 7.鉴于多元多项式能描述较为复杂的非线性问题,本专利选取用多远多项式,借 助于机器学习中多项式回归的思想,通过处理后的特征因子X训练出能描述该问题的多元 多项式的模型,形如:
[01 1 引f(X。X2,X3. . .X。)= 0 片10+P1又20+. . . + 0。-1又。0+ 0nXi。-1又2. . .Xn+- ? ?
[0113] 8.用大量的训练数据对上述模型进行训练,利用梯度下降法通过使代价函数最小 确定模型中变量前的系数,确定模型。
[0114] 指柄:
[0115] 均方误差和:
其中Si为预测值,Sd为真实值。
[0119] 9.再通过测试数据对上述模型进行测试,进行多次试验,依据指标选取合适模型, 剔除噪声点,再重复上述的训练过程,W验证模型的可用性。
[0120] 综上所述,本发明与大气扩散模型AERMO相结合,提出了优化选取进行网格划分 的评测区域的方法,减少了不必要的网格点的计算消耗,提高了预测效率;本发明提出的 方法具有可预测性,可根据事故发生前的真实气象数据进行合理的预测,降低了了W往 AERMOD模型选取评测区域的盲目性;发明提出的方法具有较好的适用性,在实际污染扩散 事故当中对应急救援能起到很好的实际场景中参考作用,降低事故中人力物力的浪费。所 W,本发明有效克服了现有技术中的种种缺点而具高度产业利用价值。
[0121] 上述实施例仅例示性说明本发明的原理及其功效,而非用于限制本发明。任何熟 悉此技术的人±皆可在不违背本发明的精神及范畴下,对上述实施例进行修饰或改变。因 此,举凡所属技术领域中具有通常知识者在未脱离本发明所揭示的精神与技术思想下所完 成的一切等效修饰或改变,仍应由本发明的权利要求所涵盖。
【主权项】
1. 一种提高大气污染模型预测效率的方法,应用于通过大气污染模型评测污染区域的 过程中,其特征在于,所述方法包括: 对原始气象数据进行预处理获取边界层参数数据和廓线数据,根据所述边界层参数数 据、所述廓线数据、污染源参数以及地形数据获取大气污染模型内各个预测网格点的污染 浓度值,根据所述污染浓度值获取关注污染物浓度的等值线并根据所述等值线获取污染影 响面积; 利用所述边界层参数数据、所述廓线数据以及所述污染影响面积建立具有预测作用的 多项式预测模型; 以存在大气污染时的实时气象数据为输入,根据所述多项式预测模型获取预测污染面 积,将所述预测污染面积和污染源的位置信息导入到大气污染模型中作为选取所述大气污 染模型中评测污染区域的依据。2. 根据权利要求1所述的提高大气污染模型预测效率的方法,其特征在于,通过对所 述各个预测网格点的污染浓度值进行插值运算获取所述关注污染物浓度的等值线。3. 根据权利要求2所述的提高大气污染模型预测效率的方法,其特征在于,所述获取 污染影响面积具体为:获取所述等值线中最远两点之间的距离,以所述距离为边长构建涵 盖所述等值线在内的正方形,获取所述正方形的面积并以所述正方形的面积作为所述污染 影响面积。4. 根据权利要求1、2或3所述的提高大气污染模型预测效率的方法,其特征在于,所述 等值线至少为两条。5. 根据权利要求1所述的提高大气污染模型预测效率的方法,其特征在于,利用所述 边界层参数数据、所述廓线数据以及所述污染影响面积建立具有预测作用的多项式预测模 型具体为: 以所述边界层参数数据和所述廓线数据为训练数据,以所述污染影响面积为因变量数 据,经过对所述训练数据的多次训练获得多项式模型,再根据均方误差和拟合优度对所述 多项式模型进行优化获得所述具有预测作用的多项式预测模型。6. 根据权利要求5所述的提高大气污染模型预测效率的方法,其特征在于,所述具有 预测作用的多项式预测模型为: f (X1, X2, X3. · · Xm) - β 〇Xj + β jX2 +. . . + β n-lXn ^ nXl X2· · · Xm 其中,Xl,X2, X3. . . \分别为边界层参数数据和廓线数据的主分量参数构成的多项式预 测模型的训练输入数据;P1... 0"分别为多项式预测模型中训练输入数据的系 数;η为模型训练输入参数的个数;m为组合项参数的个数。7. 根据权利要求6所述的提高大气污染模型预测效率的方法,其特征在于,根据均方 误差和拟合优度对所述多项式模型进行优化具体为:获取模型预测面积的均方误差的和以 及拟合优度之后,利用梯度下降法获取代价函数在最小值时多项式预测模型中系数的值。8. 根据权利要求7所述的提高大气污染模型预测效率的方法,其特征在于, 所述模型预测面积的均方误差的和》其中,SiS模型对面积的 预测值,Sh为包含等值线的正方形的真实值,η为样本数,i为样本中的第i个样本; 所述拟合优度为「,其中,r2为所建模型对问题拟合的拟合 优度,Si为模型对面积的预测值,S为模型预测面积的平均值,X i为边界层参数数据和廓线 数据的主分量参数构成的多项式预测模型的训练输入数据J为Xi的平均值; 所述代价函数为:、其中,h...为多项式预测 模型中训练输入数据的系数,r2为所建模型对问题拟合的拟合优度,S ω为第i个样本的面 积真实值,f(X(i))为第i个样本的模型对面积的预测值; 梯度下降法采用的公式,_其中,α为学习率,为多项 式预测模型训练输入数据的系数系数,β C1, P1...为多项式预测模型中训练输入数据的系 数。
【专利摘要】本发明提供一种提高大气污染模型预测效率的方法,所述方法包括:对原始气象数据进行预处理获取边界层参数数据和廓线数据并获取大气污染模型内各个预测网格点的污染浓度值,根据污染浓度值获取关注污染物浓度的等值线并根据等值线获取污染影响面积;利用边界层参数数据、廓线数据以及污染影响面积建立具有预测作用的多项式预测模型;以存在大气污染时的实时气象数据为输入,根据多项式预测模型获取预测污染面积,将预测污染面积和污染源的位置信息导入到大气污染模型的AERMAP模块中作为选取大气污染模型中评测污染区域的依据。本发明减少了AERMOD模型中不必要的网格点的计算消耗,提高了预测效率。
【IPC分类】G06F17/50
【公开号】CN104881546
【申请号】CN201510291999
【发明人】杨庭清, 徐俊, 魏建明
【申请人】中国科学院上海高等研究院
【公开日】2015年9月2日
【申请日】2015年6月1日
转载请注明原文地址:https://www.famiwei.com/read-8138530.html

最新回复(0)