基于Google Earth Engine云平台构建的多源遥感数据森林地上生物量AGB估算模型含生物量模型应用APP

最近我在 International Journal of Digital Earth (《国际数字地球学报》)发表了一篇森林生物量模型构建的文章:Evaluation of machine learning methods and multi-source remote sensing data combinations to construct forest above-ground biomass models,主要是利用多源遥感变量开展样地生物量反演具体请前往原文:https://www.tandfonline.com/doi/full/10.1080/17538947.2023.2270459

文章出发点

虽然已有一些研究探索了利用多源遥感变量估算森林 AGB 的方法(Sinha 等引文 2016;Su 等引文 2016;Sun 等引文 2011;Zhang 等引文 2020),但目前还没有具体的构建过程来选择 ML 方法和不同的遥感变量组合(Lu 引文 2006)。在此,我们采用最优 ML 方法,使用单一输入数据类型构建不同的森林 AGB 模型,并构建多源遥感变量与最优单一变量进行比较。然后根据多源遥感变量的重要性和多源遥感变量阵列之间的相关性构建多源遥感变量组合,以检验最佳森林 AGB 模型。然而,为了准确测定混交林的生物量,有必要考虑遥感数据中树种的具体差异。本文的目的是:(i) 改进不同森林类型(即阔叶林、针叶林和混交林)的 AGB 估算;(ii) 确定遥感数据的最佳组合,以提高使用 ML 方法估算森林 AGB 的准确性;(iii) 对太岳山下霍东煤矿区域内的森林进行勘探,以验证所选方法。

题目

Evaluation of machine learning methods and multi-source remote sensing data combinations to construct forest above-ground biomass models

ABSTRACT

Rapid and accurate estimation of forest biomass are essential to drive sustainable management of forests. Field-based measurements of forest above-ground biomas (AGB) can be costly and difficult to conduct. Multi-source remote sensing data offers the potential to improve the accuracy of modelled AGB predictions. Here, four machine learning methods: Random Forest (RF), Gradient Boosting Decision Tree (GBDT), Classification and Regression Trees (CART), and Minimum Distance (MD) were used to construct forest AGB models of Taiyue Mountain forest, Shanxi Province, China using single and multi-sourced remote sensing data and the Google Earth Engine platform. Results showed that the machine learning method that most accurately predicted AGB were GBDT and spectral index for coniferous (R2 = 0.99; RMSE = 65.52 Mg/ha), broadleaved (R2 = 0.97; RMSE = 29.14 Mg/ha), and mixed-species (R2 = 0.97; RMSE = 81.12 Mg/ha) forest types. Models constructed using bivariate variable combinations that included the spectral index improved the AGB estimation accuracy of mixed-species (R2 = 0.99; RMSE = 59.52 Mg/ha) forest types and reduced slightly the accuracy of coniferous (R2 = 0.99; RMSE = 101.46 Mg/ha) and broadleaved (R2 = 0.97; RMSE = 37.59 Mg/ha) forest AGB estimation. Overall, parameterizing machine learning algorithms with multi-source remote sensing variables can improve the prediction accuracy of mixed-species forests.

摘要

快速和准确地评估森林生物量对于推动森林的可持续管理至关重要。通过野外调查来评估的森林地上生物量(AGB)不仅需要耗费巨大的人力物力,且观测面积有限,随着遥感影像技术的发展,利用多源遥感数据为大面积的AGB估算提供了可能。本文利用随机森林(Random Forest,RF)、梯度提升决策树(Gradient Boosting Decision Tree,GBDT)、分类回归树(Classification and Regression Trees,CART)和最短距离法(Minimum Distance,MD)四种方法构建山西省矿林复合区(太岳山和霍东矿区)AGB模型。结果表明,四种机器学习方法中GBRT方法所构建的AGB模型精度最高,在单一变量的AGB模型中,以光谱指数构建的的AGB模型精度最高,针叶树(R2=0.99;RMSE=65.52 Mg/ha)、阔叶林(R2=0.97; RMSE=29.14 Mg/ha)和混交林(R2=0.97; RMSE=81.12 Mg/ha) 。采用光谱波段和指数的双变量组合构建的AGB模型可有效提高混交林的预测精度(R2=0.99;RMSE=59.52 Mg/ha),而针叶树(R2=0.99;RMSE=101.46 Mg/ha)和阔叶林(R2=0.97; RMSE=37.59 Mg/ha) 的模型误差略有增加。总体而言,基于多源遥感变量的机器学习算法所构建的AGB模型可以提高混交林的模型精度,而单一树种的RMSE误差会增大。

流程图

大多数科学文献并未解释如何选择合适的变量来开发和评估森林 AGB 模型。基于这一认识,我们设计了本实验,利用多源遥感变量组合构建森林 AGB 模型,然后比较不同变量组合对森林 AGB 模型的准确性,以更科学地遵循单一变量的最优组合,并揭示哪种变量组合的拟合效果最好。

为了评估不同变量组合的效用及其在估算森林 AGB 方面的准确性,我们进行了四项实验:(i) 单一变量;(ii) 多源变量组合;(iii) 变量重要性;(iv) 皮尔逊相关系数。本研究中使用的四种 ML 方法(RF、CART、GBDT 和 MD)以 n = 500 个决策树参数进行了评估。通过评估以下四个指标对每个模型进行了分析:R2、RMSE、MAE 和 RE。卫星图像处理和使用 ML 生成森林 AGB 模型的详细流程图如图所示。

卫星图像处理和基于机器学习(ML)方法生成森林地上生物量(AGB)模型的流程图。在数据处理过程中获得的六种变量类型中,特征变量合成孔径雷达(SAR)来自 ALOS-2 PALSAR 数据。光谱波段、光谱指数、Kauth-Thomas(K-T)和灰度共现矩阵(GLCM)均来自 Landsat 8 SR 图像。地形变量来自美国国家航空航天局的航天飞机雷达地形图任务(SRTM)。

模型预测结果

讨论

本研究的目的是建立一个框架,用于选择 ML 方法和变量组合,以构建一个能准确预测不同森林类型中森林 AGB 的森林 AGB 模型。许多研究报道了 RF 方法在利用遥感数据预测森林 AGB 方面的卓越性能(Chen 等引文 2018;Zhang 等引文 2023b)。本文发现,GBDT 方法具有更高的森林 AGB 预测精度,尤其是当训练数据中的样本点数量较多时。然而,RF 和 GBDT 方法之间的差异并不明显,这与之前的研究结果一致(Tamiminia 等人,引用 2022)。本研究中使用的选择最佳森林 AGB 模型的方法和过程适用于所有森林 AGB 建模。尽管研究区域是位于复杂地形的混交林,但仍有可能对森林 AGB 进行准确预测。通过比较不同变量组合建立的生物量模型,结果表明变量数量与模型精度并无直接关系,两个变量组合的模型精度优于三个或更多变量组合的模型。经过重要性和相关性筛选后的变量建立的森林 AGB 模型的精度低于最佳单一变量组合。

不区分树种的森林 AGB 模型降低了森林 AGB 估计的准确性。区分不同树种以构建树种特异性森林 AGB 模型可能会使利用遥感技术对大面积森林 AGB 的评估更加准确。然而,构建树种特异性森林 AGB 模型需要投入大量精力和资源,以获得用于训练和验证的森林样地。在太岳山森林下的霍东煤矿地区,阔叶树大多分布在海拔较低的地方,导致采样点位于居民区附近,森林样地分布零散,这可能导致除光谱指数外,其他单一变量的总体拟合度较低(Zhang 等,引用 2023a)。相比之下,针叶林大多分布在人烟稀少的高海拔地区,这增加了森林资源清查数据收集的难度,也是本研究用于训练和验证的样本量有限的原因。尽管样本量有限,但由于针叶林的斑块往往位于不常受干扰的独特斑块中,因此仍能以合理的精度估算针叶林的 AGB。不过,由于针叶树种的样本量较小,在构建变量重要性和相关变量时,可能会因样本点不足而导致模型拟合精度不稳定。因此,如果随后使用 ML 方法构建生物量模型,建议收集足够的样本点,以便进行训练和验证活动(Yang 等,引用 2023)。根据本文的实验结果,单一树种生物量模型至少需要 100 个样本点。

在单变量和多源变量生物量预测模型中,样本数量决定了模型的准确性,如图 A 和 B(补充)所示。即使不区分树种,混交林 AGB 模型的预测结果也比单独预测阔叶林和针叶林的结果要好。在不同的变量组合中,用光谱指数和 K-T 构建的最佳模型对阔叶林的 AGB 预测最好,而对针叶林和混交林的最佳变量组合是光谱指数、纹理特征、光谱指数和波段。特别是针叶林的 AGB 模型参数化了纹理特征和光谱指数,似乎弥补了由于训练和验证样本量较小而导致的预测准确率较低的问题。

结论

本研究在 GEE 云平台中使用了四种 ML 方法,利用单源和多源变量组合构建了森林 AGB 模型,并利用变量重要性值和预测 AGB 值与测量 AGB 值之间的皮尔逊相关系数对其性能进行了评估。使用包括 R2、RMSE、MAE 和 RE 的完整模型评价系统来确定预测森林 AGB 的最佳模型。结果表明,使用 GBDT ML 方法获得了最佳模型结果。混交林的生物量估算最为准确。多源遥感数据和 ML 方法能够准确估算森林 AGB 生物量,从而快速估算复杂地形景观中的森林生产力、常量生物量和碳储量。

生物量预测模型应用APP


为了帮助可视化和解释,开发了三个基于 GEE 的应用程序,即

森林生物量与变量相关性分析应用程序

(https://bqt2000204051.users.earthengine.app/view/forest-agb-variables-correlation-analysis)

森林生物量与变量重要性分析应用程序

(https://bqt2000204051.users.earthengine.app/view/forest-agb-variable-importance-analysis)

森林生物量预测应用程序

(https://bqt2000204051.users.earthengine.app/view/forest-aboveground-biomass-prediction)

将选定的多源遥感变量与采集的森林生物量相关联,并根据相关系数筛选出相关性高的遥感变量,用于生物量建模。

数百个变量的相关性分析结果包括相关系数和 p 值。森林生物量和变量重要性分析应用程序根据多源遥感变量和森林生物量进行变量重要性分析,并根据变量重要性结果选择多源遥感变量建立模型,变量重要性分析中提供了 RF、CART 和 GBDT ML 方法。森林生物量预测应用程序以上述应用程序为基础,但对其进行了扩展,允许用户使用本分析中使用的 30 种多源变量组合选择不同的 ML 方法进行生物量模型预测,并可在线比较森林 AGB 估计值和准确性(即 R2、RMSE、MAE 和 RE)的评估结果。

文章引用:

Xingguang Yan, Jing Li, Andrew R. Smith, Di Yang, Tianyue Ma, YiTing Su & Jiahao Shao (2023) Evaluation of machine learning methods and multi-source remote sensing data combinations to construct forest above-ground biomass models, International Journal of Digital Earth, 16:2, 4471-4491, DOI: 10.1080/17538947.2023.2270459

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/128614.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

欧科云链研究院:如何降低Web3风险,提升虚拟资产创新的安全合规

在香港Web3.0行业,技术推动了虚拟资产投资市场的快速增长,但另一方面,JPEX诈骗案等行业风险事件也接连发生,为Web3行业发展提供了重要警示。在近期的香港立法会施政报告答问会上,行政长官李家超表示,与诈骗…

C++进阶语法——STL 标准模板库(下)(Standard Template Library)【学习笔记(七)】

文章目录 STL 代码示例1、迭代器2、算法3、array容器示例4、vector示例5、deque(double ended queue,双端数组)示例6、list(链表)容器7、set示例8、map示例9、stack 示例10、queue示例11、priority_queue (…

FFmpeg系列索引

第一章 初识FFmpeg https://blog.csdn.net/huantianxidi/article/details/134130159 第二章 ffplay是什么 https://blog.csdn.net/huantianxidi/article/details/134151043

图像特征Vol.1:计算机视觉特征度量|第二弹:【统计区域度量】

目录 一、前言二、统计区域度量2.1:图像矩特征2.1.1:原始矩/几何矩2.1.2:中心距2.1.3:归一化的中心矩2.1.4:不变矩——Hu矩2.1.5:OpenCv实现矩特征及其应用 2.2:点度量特征2.3:全局直…

在 GORM 中定义模型

为实现与数据库的无缝交互而打造有效模型的全面指南 在使用 GORM 进行数据库管理时,定义模型是基础。模型是您的应用程序的面向对象结构与数据库的关系世界之间的桥梁。本文深入探讨了在 GORM 中打造有效模型的艺术,探讨如何创建结构化的 Go 结构体&…

从零开始的目标检测和关键点检测(三):训练一个Glue的RTMPose模型

从零开始的目标检测和关键点检测(三):训练一个Glue的RTMPose模型 一、重写config文件二、开始训练三、ncnn部署 从零开始的目标检测和关键点检测(一):用labelme标注数据集 从零开始的目标检测和关键点检测…

若依微服务集成Mybatis-plus详细教程

本章教程,主要介绍,若依开源框架微服务版本,如何集成Mybatis-plus。 目录 一、引入依赖 1、在根pom.xml中的properties里加入Mybatis-plus版本 2、在根pom.xml中引入Mybatis-plus依赖

C++学习

一、C基本介绍 1.1 C是什么 C是一种通用的、高级的编程语言,它是C语言的扩展和改进版本。C由Bjarne Stroustrup博士在20世纪80年代初开发,旨在为程序员提供更多的功能和工具,以便更轻松地编写复杂的软件程序。 拜一拜祖师爷,保佑在…

左移测试,如何确保安全合规还能实现高度自动化?

「云原生安全既是一种全新安全理念,也是实现云战略的前提。 基于蚂蚁集团内部多年实践,云原生PaaS平台SOFAStack发布完整的软件供应链安全产品及解决方案,包括静态代码扫描Pinpoint,软件成分分析SCA,交互式安全测试IA…

二、GRE VPN

GRE VPN 1、GRE介绍2、GRE基本原理3、GRE报文格式4、报文在GRE中传输过程5、价值6、Keepalive检测7、GRE应用8、配置GRE隧道8.1、配置绑定GRE协议的接口8.2、配置Tunnel接口8.3、配置Tunnel路由 9、GRE配置举例9.1、GRE静态路由示例9.1.1、路由器运行动态路由协议实现互通9.1.2…

NEFU数字图像处理(3)图像分割

一、图像分割的基本概念 1.1专有名词 前景和背景 在图像分割中,我们通常需要将图像分为前景和背景两个部分。前景是指图像中我们感兴趣、要分割出来的部分,背景是指和前景不相关的部分。例如,对于一张人物照片,人物就是前景&…

mysql迁移data目录(Linux-Centos)

随着时间的推移,mysql的数据量越越大,使用yum默认安装的目录为系统盘 /var/lib/mysql,现重新挂载了一个硬盘,需要做数据目录的迁移到 /mnt/data/。以解决占用系统盘过高情况。 1.强烈建议这种操作。镜像一个一样的Centos系统&…

系统架构设计师-第18章-安全架构设计理论与实践-软考学习笔记

安全架构概述 信息的可用性、元略性、机密性、可控性和不可抵赖性等安全保障显得尤为重要,而满足这些诉求,离不开好的架构设计. 信息安全面临的威胁 常见的安全威胁有以下几种. (1)信息泄露 (2) 破坏信息的元整性: 数据被非授极地进行增删、修改成破坏…

MyBatis无法读取XML中的Method的乌龙事件

事件背景 同事反馈,相同的jar包,在多人本地的电脑、多台服务器中,都是可以正常启动的,只有在其中一台服务器,简称它为A,无法启动,因为启动后的初始化操作中有一个调用mybatis方法的操作&#x…

11.Linux系统:定时任务备份mysql数据库为文件并传输到其他服务器

1. 创建脚本 mysql_dumps.sh内容如下: #!/bin/bash # 查找名称为“mysql_mysql”的容器id CONTAINER_IDdocker ps -a | grep "mysql_mysql" | awk {print $1} | head -n 1 MYSQL_USERNAME"root" MYSQL_PASSWORD"root" FILENAME_SU…

【CSDN 每日一练 ★★☆】【动态规划】最小路径和

【CSDN 每日一练 ★★☆】【动态规划】最小路径和 动态规划 题目 给定一个包含非负整数的 m x n 网格 grid ,请找出一条从左上角到右下角的路径,使得路径上的数字总和为最小。 说明:每次只能向下或者向右移动一步。 示例 示例 1&#x…

我的云栖大会之旅:见证云计算创新的15年

云栖大会,曾经是一次不可思议的科技之旅,却如今已见证了我对云计算世界的15年关注和发展。第一次踏上云栖大会之旅,我记得是在2009年。那时的云计算还是一个新生事物,而云栖大会正是其中的奠基石。 我清楚地记得那个炎热的夏天&am…

ant-design-vue select选择框无法显示placehoder

将绑定的对应值设置成undefined <a-selectv-model:value"formState.classification"option-filter-prop"children"allow-clearplaceholder"商户分类"><a-select-optionv-for"item of Object.values(Const.POINTMERCHNANDISE.TYPE…

R -- 体验 stringdist

文章目录 安装使用stringdist :返回列表example stringdistmatrix &#xff1a;返回矩阵example amatch & ain延伸&#xff1a;距离计算公式Hamming distanceLongest Common Substring distanceLevenshtein distance (weighted)The optimal string alignment distance dosa…

“解耦表示学习”+“交互作用(效应)+权衡 (Trade-off)”是什么?

一、解耦表示学习 一个例子说明问题&#xff1a; 假设我们有一组人脸图像。图像中的每张人脸都可能由多种因子组成&#xff0c;如面部表情、发型、眼镜、性别等。解耦表示学习的目标是找到一种表示方法&#xff0c;其中每一部分的表示只对应于一个因子&#xff0c;如一个特征…