基于机器学习的小样本空气质量预测
  • ISSN:3135-7598(Print) 3135-7601(Online)
  • DOI:
  • 出版频率:半月刊
  • 语言:中文
  • 收录数据库:Crossref

基于机器学习的小样本空气质量预测

李佳璇

辽宁师范大学 辽宁 大连 116029

摘要:空气污染精准预测对公共健康预警和环境政策制定具有重要意义,但细颗粒物(PM2.5)浓度预测面临历史数据匮乏和区域间气象-排放模式差异显著的双重挑战,传统深度学习方法在小样本场景下泛化能力严重不足。针对这一问题,本文提出了一种基于模型无关元学习(MAML)的全连接神经网络预测模型(MAML-ANN), 旨在学习跨城市的通用知识,实现对新目标城市仅用极少量观测样本即可快速、精准适配。在方法设计上,首先构建了一个维度为 23 的输入特征向量,系统融合了气象特征、多尺度滞后特征、时序差分、周期性时间编码及城市嵌入信息, 其中城市嵌入层用于捕获不同城市的固有静态属性。模型主体采用三层全连接网络作为基学习器,参数量控制在 1.5 万以内,与 MAML 的小样本场景高度匹配。元学习器负责在多个源域城市上执行双层优化:内循环通过单步梯度下降在支持集上快速生成任务专属参数,外循环则在查询集上优化元损失以更新全局初始化参数。模型集成了权重衰减、早停、梯度裁剪及学习率调度等多重正则化策略, 有效抑制了小样本下的过拟合风险。实验在多个城市空气质量数据集上验证了所提模型的有效性。结果表明, MAML-ANN 在仅有 5 至 50 个训练样本的极端小样本条件下, 仍能取得优于传统预训练-微调及独立训练方案的预测精度,且计算复杂度适中。该模型为数据稀缺区域的高精度空气质量预测提供了一种高效、可行的解决方案, 其元学习框架亦可推广至其他环境监测时序预测任务。空气污染精准预测对公共健康预警和环境政策制定具有重要意义,但细颗粒物(PM2.5)浓度预测面临历史数据匮乏和区域间气象-排放模式差异显著的双重挑战,传统深度学习方法在小样本场景下泛化能力严重不足。针对这一问题,本文提出了一种基于模型无关元学习(MAML)的全连接神经网络预测模型(MAML-ANN),旨在学习跨城市的通用知识,实现对新目标城市仅用极少量观测样本即可快速、精准适配。

关键词:小样本学习;模型无关元学习;空气质量预测;跨城市知识迁移

[1] YANG  Y, CERMAK J, CHEN X, et al.   High-resolution pm10 estimation using satellite data and model-agnostic meta-learning[J/OL]. Remote Sensing, 2024, 16(13):  2498. DOI: 10.3390/rs16132498.

[2]  HE R R, CHEN Y Q, TIAN L, et al.  Constructing and evaluating predictors for data-driven pm2.5 forecasting models [J/OL]. International Journal of Environmental Research, 2025, 19:  99. DOI: 10.1007/s41742-025-00767-x.

[3] FINN C, ABBEEL P, LEVINE S. Model-agnostic meta-learning for fast adaptation of deep networks[C]//Proceedings of the 34th International Conference on Machine Learning:  Vol. 70.  JMLR.org, 2017:  1126-1135.

[4] NICHOL A, ACHIAM J, SCHULMAN J.  On first-order meta-learning algorithms[A].  2018.

[5]DEY   P,  et  al.     Fewshot-airnet:    Temporal   2d-variation  modeling  for  air  pollution  forecasting[C]//2025  IEEE International Conference on Data Mining (ICDM). Brisbane, Australia, 2025.

作者简介:李佳璇(2002—),女,汉族,辽宁省锦州市,硕士研究生,辽宁师范大学,研究方向为CAD。