CN119577698B - 一种非一致性场景下的水质指标区间预测方法 - Google Patents

一种非一致性场景下的水质指标区间预测方法 Download PDF

Info

Publication number
CN119577698B
CN119577698B CN202510135862.3A CN202510135862A CN119577698B CN 119577698 B CN119577698 B CN 119577698B CN 202510135862 A CN202510135862 A CN 202510135862A CN 119577698 B CN119577698 B CN 119577698B
Authority
CN
China
Prior art keywords
runoff
water quality
sequence
distribution
value
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Active
Application number
CN202510135862.3A
Other languages
English (en)
Other versions
CN119577698A (zh
Inventor
张景峥
赵谊
罗超
魏浪
陶维中
张庆
吴维兴
张小清
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
PowerChina Guiyang Engineering Corp Ltd
PowerChina Ecological Environment Design and Research Co Ltd
Original Assignee
PowerChina Guiyang Engineering Corp Ltd
PowerChina Ecological Environment Design and Research Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by PowerChina Guiyang Engineering Corp Ltd, PowerChina Ecological Environment Design and Research Co Ltd filed Critical PowerChina Guiyang Engineering Corp Ltd
Priority to CN202510135862.3A priority Critical patent/CN119577698B/zh
Publication of CN119577698A publication Critical patent/CN119577698A/zh
Application granted granted Critical
Publication of CN119577698B publication Critical patent/CN119577698B/zh
Active legal-status Critical Current
Anticipated expiration legal-status Critical

Links

Classifications

    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F18/00—Pattern recognition
    • G06F18/20—Analysing
    • G06F18/27—Regression, e.g. linear or logistic regression
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F17/00—Digital computing or data processing equipment or methods, specially adapted for specific functions
    • G06F17/10—Complex mathematical operations
    • G06F17/18—Complex mathematical operations for evaluating statistical data, e.g. average values, frequency distributions, probability functions, regression analysis
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06Q—INFORMATION AND COMMUNICATION TECHNOLOGY [ICT] SPECIALLY ADAPTED FOR ADMINISTRATIVE, COMMERCIAL, FINANCIAL, MANAGERIAL OR SUPERVISORY PURPOSES; SYSTEMS OR METHODS SPECIALLY ADAPTED FOR ADMINISTRATIVE, COMMERCIAL, FINANCIAL, MANAGERIAL OR SUPERVISORY PURPOSES, NOT OTHERWISE PROVIDED FOR
    • G06Q10/00—Administration; Management
    • G06Q10/06—Resources, workflows, human or project management; Enterprise or organisation planning; Enterprise or organisation modelling
    • G06Q10/063—Operations research, analysis or management
    • G06Q10/0631—Resource planning, allocation, distributing or scheduling for enterprises or organisations
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06Q—INFORMATION AND COMMUNICATION TECHNOLOGY [ICT] SPECIALLY ADAPTED FOR ADMINISTRATIVE, COMMERCIAL, FINANCIAL, MANAGERIAL OR SUPERVISORY PURPOSES; SYSTEMS OR METHODS SPECIALLY ADAPTED FOR ADMINISTRATIVE, COMMERCIAL, FINANCIAL, MANAGERIAL OR SUPERVISORY PURPOSES, NOT OTHERWISE PROVIDED FOR
    • G06Q50/00—Information and communication technology [ICT] specially adapted for implementation of business processes of specific business sectors, e.g. utilities or tourism
    • G06Q50/10—Services
    • G06Q50/26—Government or public services
    • Y—GENERAL TAGGING OF NEW TECHNOLOGICAL DEVELOPMENTS; GENERAL TAGGING OF CROSS-SECTIONAL TECHNOLOGIES SPANNING OVER SEVERAL SECTIONS OF THE IPC; TECHNICAL SUBJECTS COVERED BY FORMER USPC CROSS-REFERENCE ART COLLECTIONS [XRACs] AND DIGESTS
    • Y02—TECHNOLOGIES OR APPLICATIONS FOR MITIGATION OR ADAPTATION AGAINST CLIMATE CHANGE
    • Y02A—TECHNOLOGIES FOR ADAPTATION TO CLIMATE CHANGE
    • Y02A20/00—Water conservation; Efficient water supply; Efficient water use
    • Y02A20/152—Water filtration

Landscapes

  • Engineering & Computer Science (AREA)
  • Business, Economics & Management (AREA)
  • Physics & Mathematics (AREA)
  • Theoretical Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Data Mining & Analysis (AREA)
  • Human Resources & Organizations (AREA)
  • Strategic Management (AREA)
  • Tourism & Hospitality (AREA)
  • Economics (AREA)
  • Mathematical Optimization (AREA)
  • Evolutionary Biology (AREA)
  • General Business, Economics & Management (AREA)
  • Marketing (AREA)
  • General Engineering & Computer Science (AREA)
  • Mathematical Physics (AREA)
  • Entrepreneurship & Innovation (AREA)
  • Pure & Applied Mathematics (AREA)
  • Operations Research (AREA)
  • Development Economics (AREA)
  • Life Sciences & Earth Sciences (AREA)
  • Bioinformatics & Cheminformatics (AREA)
  • Bioinformatics & Computational Biology (AREA)
  • Computational Mathematics (AREA)
  • Educational Administration (AREA)
  • Mathematical Analysis (AREA)
  • Databases & Information Systems (AREA)
  • Quality & Reliability (AREA)
  • Probability & Statistics with Applications (AREA)
  • Game Theory and Decision Science (AREA)
  • Algebra (AREA)
  • Health & Medical Sciences (AREA)
  • Primary Health Care (AREA)
  • Software Systems (AREA)
  • General Health & Medical Sciences (AREA)
  • Artificial Intelligence (AREA)
  • Computer Vision & Pattern Recognition (AREA)
  • Evolutionary Computation (AREA)
  • Management, Administration, Business Operations System, And Electronic Commerce (AREA)

Abstract

本发明公开了一种非一致性场景下的水质指标区间预测方法,包括以下步骤:获取指定时间段内径流时间序列和水质时间序列,执行非一致性综合判断;采用多种概率分布模型,分别对径流时间序列和水质时间序列进行拟合,确定最佳概率分布模型;构建AR模型,实现径流的随机模拟,输出模拟径流序列;对模拟径流序列进行调整,获取非一致性场景;构建二维联合Copula函数模型,向二维联合Copula函数模型输入未来非一致性场景,输出水质预测序列集;从水质的模拟序列集提取实测期水质点模拟值和实测值之间的残差集合抽取残差样本集,根据残差样本集实现水质指标区间预测。根据上述技术方案,可以得出非一致性背景下水质数据的点预测和水质区间预测。

Description

一种非一致性场景下的水质指标区间预测方法
技术领域
本发明涉及水质指标预测技术领域,具体而言,涉及一种非一致性场景下的水质指标区间预测方法。
背景技术
随着社会发展,生活用水、工业用水和农业用水的用量在不断增加,对水资源的需求也日益增大。然而,日益严峻的水体污染成为目前我国面临的主要水问题之一。在此情况下,对表征水体污染状况的各项水质指标进行模拟和预测也成为水质研究的热点和关键。
在实际使用中,常通过对采集水样来监测各项指标值(如pH值、高锰酸钾指数、氨氮、总磷、总氮等),并依据《地表水环境质量标准》中各项水质指标的限值将水体分为五类。
现阶段,已有不少研究针对水质进行了模拟。这些研究大多采用统计模型、水文模型、机器学习和深度学习,以及多种方法耦合等手段,基于历史期的其他水文数据序列进行水质模拟,进而得出相应的水质指标序列。然而,变化环境下,全球范围内的水文非一致性过程愈加明显,传统的水文一致性已不适用实际环境,因此,基于历史期水文数据的水质模拟结果的合理性还需要进一步确认,并需要在各水文数据表现出非一致性的情况下,对与水文数据存在相关性的水质指标数据进行进一步分析和模拟。
非一致性水文数据的特征表现在其统计特征和参数等随时间产生了变化,这导致传统观点认为的水文模拟过程中呈“稳态”的假定不再适用。而目前常用的方案为基于一致性假设进行水质点预测,即输入序列不考虑随时间变化的统计特征和参数,且不能突出水质模拟数据的不确定性。因此,需要一种水质模拟的方法,从非一致性背景出发,综合考虑多种非一致性输入和水质样本代表性中的不确定性,实现非一致性的水质数据的点预测和区间预测。
发明内容
实现上述目的,本申请提供了一种非一致性场景下的水质指标区间预测方法,包括以下步骤:
获取实测期内径流时间序列和水质时间序列,执行非一致性综合判断;
采用多种概率分布模型,分别对径流时间序列和水质时间序列进行拟合,根据拟合优度检验确定最佳概率分布模型;
构建AR模型,实现径流的随机模拟,输出预测的模拟径流序列;对模拟径流序列进行调整,获取非一致性场景;
构建二维联合Copula函数模型,向二维联合Copula函数模型输入非一致性场景,输出水质的预测序列集;
获取实测期内实测径流,向所述二维联合Copula函数模型,输入实测径流,得到水质的模拟序列集,提取实测期水质点模拟值和实测值之间的残差集合抽取残差样本集,根据残差样本集实现水质指标区间预测。
其中,执行非一致性综合判断包括:
通过MK趋势分析方法获取各时间序列的变化趋势,包括:使用标准正态分布进行假设检验,以MK统计量大于或小于95%置信水平的临界值判断时间序列的趋势变化;
通过MK突变检验方法判断各时间序列的非一致性背景,包括:取95%的置信水平,判断检验量曲线和在置信区间内是否相交,如果相交,则判断时间序列在交点处产生了显著突变,呈现出非一致性;
通过相关性分析获取径流序列与水质序列间的相关程度,包括:当相关性系数大于0时,则表示两序列间存在正相关性,反之则存在负相关性;其绝对值越接近于1,相关性程度越大。
进一步的,采用多种概率分布模型包括:确定径流时间序列和各水质时间序列的概率分布特征,所述概率分布特征包括:极值分布、指数分布、伽马分布、广义极值分布、广义帕累托分布、对数正态分布、正态分布和威布尔分布;
拟合优度包括:AIC值、RMSE值和KS检验的统计量;
根据拟合优度检验确定最佳概率分布模型的依据包括:KS检验的统计量等于1时说明满足假设的分布特征;RMSE值越小,拟合程度越好;AIC值越小,拟合程度越好。
其中,AR模型由随机扰动项和时间序列的部分项目的加权之和组成:表示为:
,其中,为t时刻的径流模拟值、为自回归阶数、为自回归系数、为噪声项;
对模拟径流序列进行调整指:通过统计因子调整法和径流季节性变异模拟非一致场景;所述非一致场景包括:均值上升、均值下降、上升、下降、季节前移、季节滞后;
进一步的,统计因子调整法用于根据非一致性条件对序列统计特征参数的影响模拟非一致性场景,所述场景包括均值非一致性和非一致性;
生成均值的场景时,,其中,和分别为均值非一致性场景下的径流序列和AR模型得到的模拟径流序列,为调整因子;
生成的场景时,保证均值不变的情况下,,其中,表示非一致性场景下的径流序列;为径流均值。
进一步的,径流季节性变异用于体现非一致性条件对径流季节性的影响;
径流季节性变异通过累计时间分布函数实现径流在季节非一致性条件下的重构模型,重构模型表示为:
,
,
,
其中,为时间序列中第个累计时间分布函数,为时间序列长度,和分别表示实测径流时间序列和季节非一致性场景下的径流时间序列,、和分别表示非一致性场景下、非一致性变化前和非一致性变化后三角形入流过程线的累计时间分布函数。
构建二维联合Copula函数模型包括:
确定模拟所用的水质指标序列;径流;
确定径流和水质指标序列的边缘分布;
选择合适的Copula函数,描述径流和水质指标间的相关性结构。
进一步的,抽取残差样本集时,采用Bootstrap方法,对实测期水质点模拟值和实测值之间的残差集合有放回的抽取次,得到组新的残差样本集。
根据所述残差样本集实现水质指标区间预测指:在95%和90%的置信水平上,进行模拟残差的区间预测,计算模拟水质数据的上下限。
本发明从非一致性背景出发,通过场景模拟考虑多种非一致性输入,进而得出代表非一致性的水质数据的点预测;其次,通过考虑水质样本代表性中的不确定性,对水质数据做出区间预测。利用本发明得到的水质模拟数据综合考虑了非一致性的影响以及样本代表性中的不确定性,具有一定的实际价值和理论价值。
附图说明
图1是根据本发明实施例提供的非一致性场景下的水质指标区间预测方法步骤图;
图2是根据本发明实施例提供的实测径流序列的非一致性综合诊断结果示意图;
图3是根据本发明实施例提供的径流与水质序列间的相关性热图;
图4是根据本发明实施例提供的各非一致性场景下的径流模拟序列示意图;
图5是根据本发明实施例提供的场景1下的水质模拟结果示意图;
图6是根据本发明实施例提供的场景2下的水质模拟结果示意图;
图7是根据本发明实施例提供的场景3下的水质模拟结果示意图;
图8是根据本发明实施例提供的场景4下的水质模拟结果示意图;
图9是根据本发明实施例提供的场景5下的水质模拟结果示意图;
图10是根据本发明实施例提供的场景6下的水质模拟结果示意图;
图11是根据本发明实施例提供的场景1中95%置信水平下4项水质的点和区间预测示意图;
图12是根据本发明实施例提供的场景1中90%置信水平下4项水质的点和区间预测示意图。
具体实施方式
本发明从非一致性背景出发,通过场景模拟多种非一致性输入,进而得出代表非一致性的水质数据的点预测;其次,通过分析水质样本中的不确定性,对水质数据做出区间预测。具体实现时,首先通过非一致性诊断明确径流数据的非一致性背景,同时采用8种不同的概率分布模型,根据实际需求确定需要模拟的水质指标,通过拟合优度检验确定出适合研究区水质数据及径流数据的最佳概率分布;其次,基于径流的自相关性,通过AR模型进行径流随机模拟,再利用非一致性场景模拟技术生成6种不同的径流非一致性情景;最后,通过Copula函数构建二维模型,以不同非一致性径流情景为输入,模拟出不同非一致性情景下的水质变化情况,并利用Bootstrap方法对实测期模拟数据和观测数据的残差进行有放回抽样,最终得出不同置信水平下,水质模拟数据的点预测和区间预测。
下面结合说明书附图对本发明的具体实现方式做详细描述。
图1提供了本发明提出的非一致性场景下的水质指标区间预测方法,包括以下步骤:
步骤S100:获取实测期内径流时间序列和水质时间序列,执行非一致性综合诊断;
在本发明中,首先需要明确径流数据的非一致性背景,为后续步骤提供理论依据。本发明采用综合检验方法对径流时间序列和水质时间序列进行平稳性检验以实现非一致性综合诊断,主要包括:
1)通过MK趋势分析方法获取各时间序列的变化趋势,包括:使用标准正态分布进行假设检验,以MK统计量大于或小于95%置信水平的临界值判断时间序列的趋势变化;
MK趋势分析统计量的算法包括:
,其中,表示MK趋势检验的中间统计量,和表示时间序列的序号,为序数长度,、为序列指定序号的径流值或水质值;
其中,、的数据关系表示为:
;
进一步的,,
,表示的方差,表示MK趋势检验的结果统计量。
2)通过MK突变检验方法判断各时间序列的非一致性背景,包括:取95%的置信水平,判断检验量曲线向前统计量和向后统计量在置信区间内是否相关相交,如果相交,则判断时间序列在交点处产生了显著突变,呈现出非一致性;
具体计算表示为:
,
,
,
,
,
,
其中,表示MK突变检验的中间统计量,和分别表示序列的均值和方差,和分别表示MK突变检验的向前统计量和向后统计量。
3)通过相关性分析明确径流序列与水质序列间的相关程度,本发明采用相关系数法进行相关性分析,包括:当相关性系数大于0时,则表示两序列间存在正相关性,反之则存在负相关性;其绝对值越接近于1,相关性程度越大。
本专利采用Pearson、Kendall、Spearman三种不同的相关性系数对径流序列和多种水质序列进行相关性分析。
Pearson分析方法表示为:,
Kendall方法表示为:,
Spearman方法表示为:,
式中,、和分别表示Pearson相关系数、Kendall相关系数和Spearman相关系数;和分别表示长度为的时间序列,和分别表示其均值;C和D分别表示两个时间序列中有和没有一致性的元素对数;和分别表示第个值在序列中的大小排序号,和分别表示序号均值。
本发明提供了具体的案例:采用某地水文站2007年10月至2018年9月间的月尺度径流数据,及同期的4项月尺度水质数据:高锰酸钾指数(CODMn, mg/L)、溶氧量(DO, mg/L)、氨氮量(NH4N, mg/L)、PH值(PH)。
首先,对案例数据进行非一致性检验,结果如图2所示,表明径流在实测期内多处存在非一致性变化,即非一致性背景现实存在。
在非一致性检验过程中,对径流数据和4项水质数据进行相关性分析,结果如图3所示,表明径流序列与CODMn序列、NH4N序列、PH序列存在负相关性,与DO序列存在正相关性。
步骤S110:采用多种概率分布模型,分别对所述径流时间序列和水质时间序列进行拟合,根据拟合优度检验确定最佳概率分布模型;
在本步骤中,定义径流时间序列和各水质时间序列多种概率分布特征,具体包括:极值分布(EV)、指数分布(EXP)、伽马分布(GAM)、广义极值分布(GEV)、广义帕累托分布(GP)、对数正态分布(LOGN)、正态分布(NORM)、威布尔分布(WBL)等8种不同的概率分布;
后续根据Kolmogorov-Smirnov (KS)检验、均方根误差准则(RMSE)、Akaikeinformation criterion (AIC信息准则)等3种不同的拟合优度检验确定各时间序列最优的概率分布模型。
具体的,EV分布满足概率密度函数:;
EXP分布满足概率密度函数:;
GAM分布满足概率密度函数:;
GEV分布满足概率密度函数:;
GP分布满足概率密度函数:;
LOGN分布满足概率密度函数:;
NORM分布满足概率密度函数:;
WBL分布满足概率密度函数:。
根据拟合优度检验确定最佳概率分布模型的依据包括:KS检验的统计量等于1时说明满足假设的分布特征;RMSE值越小,拟合程度越好;AIC值越小,拟合程度越好。
具体的:
KS检验的统计量为,当其等于1时表示在给定的显著性水平上满足假设的分布特征,反之则不满足,表示为:,式中,表示序列的累计经验分布函数,表示经验频率;
RMSE值越小,拟合程度越好,表示为:,式中,表示经验频率,表示理论频率;
AIC值越小,拟合程度越好,表示为:,式中,表示模型参数个数。
根据本发明提供的案例,采用AIC信息准则、RMSE、KS检验等三种不同的拟合优度检验方法确定径流序列和4项水质序列的最佳概率分布模型,分布结果如表1所示:
表1
结果表明,径流序列的最优概率分布为GP、CODMn序列的最优概率分布为LOGN、DO序列的最优概率分布为GEV、NH4N序列的最优概率分布为LOGN、PH序列的最优概率分布为EV。
步骤S120:构建AR模型,实现径流的随机模拟,输出模拟径流序列;对模拟径流序列进行调整,获取非一致性场景;
由于径流具有自相关性和随机性,因此采用AR模型对径流进行随机模拟。
AR模型由随机扰动项和时间序列的部分项目的加权之和组成:表示为:
,其中,为t时刻的径流模拟值、为自回归阶数、为自回归系数、为噪声项;
各时刻的径流模拟值构成径流模拟序列。
获得径流模拟序列后,对模拟径流序列进行调整,生成多种非一致性场景。
在本发明中,对模拟径流序列进行调整指:通过统计因子调整法和径流季节性变异模拟非一致性场景;非一致性场景包括:均值上升(场景1)、均值下降(场景2)、上升(场景3)、下降(场景4)、季节前移(场景5)、季节滞后(场景6);
其中,统计因子调整法用于根据非一致性条件对序列统计特征参数的影响模拟非一致性场景,所述场景包括均值非一致性和非一致性;
生成均值的场景时,可以在保证其他参数不变的情况下,由AR模型得到的模拟序列在5%水平上放大或缩小,这样就得到均值非一致性场景下的径流输入:,其中,和分别为均值非一致性场景下的径流序列和AR模型得到的模拟径流序列,为调整因子;
生成的场景时,保证均值不变的情况下,将由AR模型得到的模拟序列的值在5%水平上放大或缩小,这样就得到非一致性场景下的径流输入,表示为:,其中,表示非一致性场景下的径流序列;为径流均值。
径流季节性变异主要关注于径流时间序列的季节性变化,用于体现一致性条件对径流季节性的影响;本发明中主要生成前移非一致性和滞后非一致性的场景。
具体的,径流季节性变异通过累计时间分布函数()进行时间尺度上的调整,通过对季节性因子进行调整,实现径流在季节非一致性条件下的重构模型,重构模型表示为:
,
,
,
其中,为时间序列中第个累计时间分布函数,为时间序列长度,和分别表示实测径流时间序列和季节非一致性场景下的径流时间序列,、和分别表示非一致性场景下、非一致性变化前和非一致性变化后三角形入流过程线的累计时间分布函数。
对于本发明提供的案例,利用AIC和贝叶斯信息准则确定出最大自回归阶数,进而构建径流AR模型,通过AR模型对径流序列进行模拟,模拟序列长度设为100。在获得径流模拟序列后,通过统计因子调整法和季节性变异法,对模拟径流序列进行调整,进而得到了6种径流的非一致性场景(如图4所示)。其中,场景1-4代表了径流序列统计特征(均值、)非一致性,其变异幅度为5%;场景5-6代表了径流季节非一致性,分别代表了前移和滞后。
六种非一致性场景构成后,即可在二维联合Copula函数模型中生成水质的模拟序列。
步骤S130:构建二维联合Copula函数模型,向所述二维联合Copula函数模型输入所述非一致性场景,可输出水质的预测的模拟序列集;
Copula函数可以将多个变量的边缘分布和它们之间的相关性结构分开研究,且对边缘分布的类型没有任何限制,它既可以描述非线性相关关系,又可以描述非对称相关关系。Copula函数能基于变量间的复杂关系为水质预测提供一种灵活有效的模拟方法。
本发明中采用的Copula函数包括Gumbel Copula、Clayton Copula和FrankCopula三种类型:
Gumbel Copula表示为:,
Clayton Copula表示为:,
Frank Copula表示为:,其中,为Copula函数的参数。
基于Sklar定理,设为具有边缘分布和的联合分布函数,则存在一个Copula函数满足公式(34),若和连续,则就被唯一确定。
因此,在本发明中,首先确定模拟所用的水质指标序列;径流;
确定径流和水质指标序列的边缘分布,表示为:;
选择合适的Copula函数,描述径流和水质指标间的相关性结构。
最后,基于最优的Copula函数和构建好的二维联合Copula函数模型,将非一致性场景输入到模型中,得出各项水质的模拟序列。
在本发明提供的案例中,使用Copula函数构建非一致性二维水质联合随机模拟模型,利用3种不同的Copula函数,分别对径流数据和水质数据进行拟合,确定出FrankCopula为最优Copula函数。
进一步的,将6种非一致性场景输入到构建好的Frank Copula模型中,可得到场景1至场景6的4项水质数据的模拟结果,如图5至图10所示。
步骤S140:获取实测期内实测径流,向二维联合Copula函数模型,输入实测径流,得到水质的模拟序列集,提取模拟序列集中实测期水质点模拟值和实测值之间的残差集合抽取残差样本集,根据残差样本集实现水质指标区间预测。
具体的,首先,通过Copula函数模拟得出实测期各水质数据的点模拟值,并计算与实测值的残差样本集合;
接下来,通过Bootstrap方法,对实测期水质点模拟值和实测值之间的残差集合有放回的抽取次,得到组新的残差样本集。具体的,Bootstrap方法不需要对总体分布做出假设,仅基于原始样本序列进行再抽样,并不断预测抽出样本的参数值,进而推断出未知总体的参数特征并可定量描述参数预测的不确定性。对于实测残差样本集,设,其总体分布参数为,Bootstrap方法可表示为:
,
,
式中,表示总体参数预测和总体分布参数差值间Bootstrap统计量;和表示第个再生样本和总体的参数预测;表示对于每一个所得到的参数预测近似值。
最后,根据所述残差样本集实现水质指标区间预测:即分别在95%和90%的置信水平上对新样本集进行抽样,得出各水质模拟序列的区间预测。具体的,对组新的残差样本集分别在95%和90%的置信水平上再次抽样,进而得出各水质序列在95%和90%的置信水平上模拟值的置信上界和下界,最终可得到各水质模拟值的区间预测。
在本发明案例中,首先通过构建好的二维Copula水质模拟模型,做出实测期4项水质数据的模拟序列,进而得到水质点模拟值和实测值之间的残差集合。再通过Bootstrap方法,将残差集合有放回的抽取1000次,得到了1000组新的残差样本集。取95%和90%的置信水平,对1000组再生残差样本进行抽样,得到了对应置信水平下的水质模拟值残差的上界和下界,进而得到水质模拟的区间预测,预测结果如表2所示:
表2
置信水平 CODMn (mg/L) DO (mg/L) NH4N (mg/L) PH
95%上界 0.13 0.40 0.23 0.10
95%下界 -0.38 -0.14 -0.26 -0.26
90%上界 0.09 0.38 0.20 0.08
90%下界 -0.33 -0.09 -0.22 -0.23
其中,以95%和90%置信水平下,场景1中4项水质数据模拟的点预测和区间预测结果如图11和图12所示。
针对目前常用的水质预测的技术方案,本发明充分考虑了非一致性条件对水质模拟的影响,并且给出了具体场景下的量化模拟结果。在模拟环境中,采用非一致性场景模拟,使用统计因子调整和季节性变异得出了具有代表性的6类不同的非一致性场景,并将这些非一致性场景作为水质模拟的输入序列,克服了以往研究中不考虑场景模拟直接进行后续的水质模拟的基础性不足;进一步的,本发明将非一致性条件作为水质模拟的主要考虑对象,将6种非一致性场景数据作为输入,通过二维水质模拟模型进而得到了非一致性条件下的水质变化情况,并与未产生非一致性时的模拟序列进行对比,改进了以往研究中直接使用历史数据或与历史数据具有一致性的数据作为输入进行模拟的方法,克服了以往的方案使结果不能代表实际情况的缺陷;另一方面,本发明充分考虑了水质样本代表性中的不确定性,并以点预测和区间预测的形式进行量化,通过Bootstrap方法对实际残差样本集进行重抽样,并将获得的再生残差样本叠加在水质点预测上,得出了水质的区间预测,相对传统技术方案中不考虑非一致性场景的水质预测,更加提高了预测结果的准确性。
以上公开的仅为本发明的几个具体实施例,但是,本发明并非局限于此,任何本领域的技术人员能思之的变化都应落入本发明的保护范围。

Claims (7)

1.一种非一致性场景下的水质指标区间预测方法,其特征在于,包括以下步骤:
获取实测期径流时间序列和水质时间序列,执行非一致性综合判断;
采用多种概率分布模型,分别对所述径流时间序列和水质时间序列进行拟合,根据拟合优度检验确定最佳概率分布模型;
构建AR模型,实现径流的随机模拟,输出模拟径流序列;对模拟径流序列进行调整,获取非一致性场景;所述AR模型由随机扰动项εt和时间序列的部分项目的加权之和组成:表示为:其中,xt为t时刻的径流模拟值、p为自回归阶数、aj为自回归系数、εt为噪声项;所述对模拟径流序列进行调整指:通过统计因子调整法和径流季节性变异模拟非一致场景;所述非一致场景包括:均值上升、均值下降、Cv上升、Cv下降、季节前移、季节滞后;
构建二维联合Copula函数模型,向所述二维联合Copula函数模型输入所述非一致性场景,可输出水质的预测的模拟序列集;
获取实测期内实测径流,向所述二维联合Copula函数模型,输入所述实测径流,得到水质的模拟序列集,提取实测期水质点模拟值和实测值之间的残差集合抽取残差样本集,根据所述残差样本集实现水质指标区间预测;
其中,所述统计因子调整法用于根据非一致性条件对序列统计特征参数的影响模拟非一致性场景,所述场景包括均值非一致性和Cv非一致性;生成均值的场景时,其中,和分别为均值非一致性场景下的径流序列和AR模型得到的模拟径流序列,K为调整因子;生成Cv的场景时,保证均值不变的情况下,其中,表示Cv非一致性场景下的径流序列;为径流均值;
所述径流季节性变异用于体现非一致性条件对径流季节性的影响,通过累计时间分布函数实现径流在季节非一致性条件下的重构。
2.根据权利要求1所述的水质指标区间预测方法,其特征在于,所述执行非一致性综合判断包括:
通过MK趋势分析方法获取各时间序列的变化趋势,包括:使用标准正态分布进行假设检验,以MK统计量大于或小于95%置信水平的临界值判断时间序列的趋势变化;
通过MK突变检验方法判断各时间序列的非一致性背景,包括:取95%的置信水平,判断检验量曲线和在置信区间内是否相交,如果相交,则判断时间序列在交点处产生了显著突变,呈现出非一致性;
通过相关性分析获取径流序列与水质序列间的相关程度,包括:当相关性系数大于0时,则表示两序列间存在正相关性,反之则存在负相关性;其绝对值越接近于1,相关性程度越大。
3.根据权利要求1所述的水质指标区间预测方法,其特征在于,采用多种概率分布模型包括:确定径流时间序列和各水质时间序列的概率分布特征,所述概率分布特征包括:极值分布、指数分布、伽马分布、广义极值分布、广义帕累托分布、对数正态分布、正态分布和威布尔分布;
所述拟合优度包括:AIC值、RMSE值和KS检验的统计量;
所述根据拟合优度检验确定最佳概率分布模型的依据包括:KS检验的统计量等于1时说明满足假设的分布特征;RMSE值越小,拟合程度越好;AIC值越小,拟合程度越好。
4.根据权利要求1所述的水质指标区间预测方法,其特征在于,所述径流季节性变异实现径流在季节非一致性条件下的重构模型表示为:
TDF'(i)=TDF(i)-TDFtri1(i)+TDFtri2(i),i=1,2,…,n,
其中,TDF(j)为时间序列中第j个累计时间分布函数,n为时间序列长度,Qi和Q'i分别表示实测径流时间序列和季节非一致性场景下的径流时间序列,TDF'(i)、TDFtri1(i)和TDFtri2(i)分别表示非一致性场景下、非一致性变化前和非一致性变化后三角形入流过程线的累计时间分布函数。
5.根据权利要求1所述的水质指标区间预测方法,其特征在于,所述构建二维联合Copula函数模型包括:
确定模拟所用的水质指标序列v;径流u;
确定径流和水质指标序列的边缘分布;
选择Copula函数,描述径流和水质指标间的相关性结构。
6.根据权利要求1所述的水质指标区间预测方法,其特征在于,所述根据所述残差样本集实现水质指标区间预测指:在95%和90%的置信水平上,进行模拟残差的区间预测,计算模拟水质数据的上下限。
7.根据权利要求1所述的水质指标区间预测方法,其特征在于,所述抽取残差样本集时,采用Bootstrap方法,对实测期水质点模拟值和实测值之间的残差集合有放回的抽取N次,得到N组新的残差样本集。
CN202510135862.3A 2025-02-07 2025-02-07 一种非一致性场景下的水质指标区间预测方法 Active CN119577698B (zh)

Priority Applications (1)

Application Number Priority Date Filing Date Title
CN202510135862.3A CN119577698B (zh) 2025-02-07 2025-02-07 一种非一致性场景下的水质指标区间预测方法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
CN202510135862.3A CN119577698B (zh) 2025-02-07 2025-02-07 一种非一致性场景下的水质指标区间预测方法

Publications (2)

Publication Number Publication Date
CN119577698A CN119577698A (zh) 2025-03-07
CN119577698B true CN119577698B (zh) 2025-04-18

Family

ID=94808490

Family Applications (1)

Application Number Title Priority Date Filing Date
CN202510135862.3A Active CN119577698B (zh) 2025-02-07 2025-02-07 一种非一致性场景下的水质指标区间预测方法

Country Status (1)

Country Link
CN (1) CN119577698B (zh)

Families Citing this family (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN120180043B (zh) * 2025-05-16 2025-08-26 北京工业大学 一种数据尾部分布的异类极端事件预测方法

Citations (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN115496290A (zh) * 2022-09-30 2022-12-20 河海大学 一种“输入-结构-参数”全要素分层组合优选的中长期径流时变概率预测方法
CN116228497A (zh) * 2023-03-28 2023-06-06 长安大学 一种流域输沙量非一致性变化识别及归因分析方法和装置

Family Cites Families (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN112116149B (zh) * 2020-09-17 2021-06-18 河海大学 一种考虑预报不确定性关联演化特征的多站中长期径流滚动概率预测方法
CN114970171B (zh) * 2022-05-31 2023-03-14 水利部交通运输部国家能源局南京水利科学研究院 考虑产流结构不确定性的水文模型及对地表地下水文过程影响的量化方法
CN115408812B (zh) * 2022-07-14 2025-06-24 扬州大学 一种考虑人类活动影响的水文干旱预测方法
CN118626809B (zh) * 2024-08-13 2024-10-25 水利部交通运输部国家能源局南京水利科学研究院 基于序列重构的径流非一致性变化识别方法及系统

Patent Citations (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN115496290A (zh) * 2022-09-30 2022-12-20 河海大学 一种“输入-结构-参数”全要素分层组合优选的中长期径流时变概率预测方法
CN116228497A (zh) * 2023-03-28 2023-06-06 长安大学 一种流域输沙量非一致性变化识别及归因分析方法和装置

Also Published As

Publication number Publication date
CN119577698A (zh) 2025-03-07

Similar Documents

Publication Publication Date Title
CN117116382B (zh) 引水工程影响下受水湖泊水质时空预测方法和系统
CN107463730B (zh) 一种考虑土地利用时空演变的径流变化归因识别方法
CN111985692B (zh) 一种基于ceemdan的用电负荷预测方法
CN111814956B (zh) 一种基于多维度二次特征提取的多任务学习的空气质量预测方法
CN119963367A (zh) 一种基于图神经网络的深度学习模型gcn-gru的水质预测方法
CN117787081A (zh) 一种基于Morris和Sobol法的水文模型参数不确定性分析方法
CN115456245A (zh) 一种感潮河网区溶解氧预测方法
CN113379116A (zh) 基于聚类和卷积神经网络的台区线损预测方法
CN109858755A (zh) 一种评价水体质量的方法
CN115905937B (zh) 一种基于深度贝叶斯神经网络的断面流域溯源方法
CN116613732A (zh) 一种基于shap值选择策略的多元负荷预测方法及系统
CN119204350A (zh) 考虑可解释深度学习模型嵌套组合的中长期水文概率预报方法及系统
CN118747279B (zh) 将河流物质通量时间降尺度的计算方法及装置、电子设备
CN119577698A (zh) 一种非一致性场景下的水质指标区间预测方法
Lim et al. Estimating unknown parameters of a building stock using a stochastic-deterministic-coupled approach
Baccarini The maturing concept of estimating project cost contingency: A review
CN113487069B (zh) 一种基于grace日降尺度和新型dwsdi指数的区域洪涝灾害风险评估方法
CN120875113A (zh) 基于机器学习耦合水文模型的河流水质预测方法与系统
CN117910659B (zh) 基于数据融合算法的土壤环境管理系统及方法
Ramli et al. Forecasting of Rainfall Using Seasonal Autoregreressive Integrated Moving Average (SARIMA) Aceh, Indonesia.
CN118396230A (zh) 一种海洋环境数据资产化价值分析系统及评估方法
CN121119304B (zh) 一种海湾营养盐污染治理多目标鲁棒优化方法
Gandhi et al. Combined Standardized Precipitation Index and ANFIS Approach for Predicting Rainfall in the Tropical Savanna Region
CN118278512B (zh) 一种基于深度学习模型可解释性的知识追踪可视分析系统
CN120125014A (zh) 基于多模态信息融合的环境风险监测平台

Legal Events

Date Code Title Description
PB01 Publication
PB01 Publication
SE01 Entry into force of request for substantive examination
SE01 Entry into force of request for substantive examination
GR01 Patent grant
GR01 Patent grant