一份绿化台账里,今年的树径比过去大了,是否就能直接写成某棵树生长了多少?如果两次记录没有可靠地对应同一棵树,数字相减得到的首先只是两条记录的差值。位置靠近是查找线索,却不能单独补上个体身份的证据。

Brian J. Mailloux等作者于2024年7月11日在PLOS ONE发表的研究,利用纽约2005与2015街道树普查分析生长。作者在方法部分说明,较早数据中的经纬度误差使同树定位困难,因此没有直接依赖地图坐标,而是采用邮政编码、地址和树种进行对齐。[1] 本文讨论这项历史研究的数据识别方法,不据此确认任何城市今天的树木状态。

对齐之前,研究先统一树种俗名,整理地址中的标点与缩写。同一地址存在多棵同树种树木时,记录会因不具唯一性而被排除。文中的例子说明,同一地址各有一棵不同树种,可以分别识别;若有两棵相同树种,单靠这些字段就难以分清。[1] 所以,“匹配到了地址”与“识别出了个体”不是同一个结果。

邮编也不是装饰性字段。作者说明,纽约不同区域可能出现重复的街名和门牌号,因此结合邮编与地址,而非只用一段文字地址。[1] 对台账整理来说,这展示了一个一般的数据问题:字段看起来更详细,不一定只是增加说明,也可能是在减少不同对象被误连的机会。

即使树种与地址相同,个体也可能已经变化。论文在地面核实中发现,有些成熟树被移除后,原处种了同种幼树;若把两个时期的记录直接串接,便可能出现很大的表观负增长。[1] 这里说的是作者报告的核实发现,并不意味着遇到负差值就能自行断定发生了补种。原文也讨论录入、测量与取整造成的其他误差。

因此,一份面向养护交接的汇总,可以把“原记录仍存在”“跨次身份已建立”和“指标变化已经计算”作为不同的信息状态。缺少身份依据时,保留待匹配,比把附近记录直接填入同一条生长曲线更稳妥。这是本文从研究方法提炼的数据说明思路,不是已经执行过的树木核查,也不提供现场量测或养护操作。

研究者同时承认,排除同址同种的含混记录可能造成样本偏向,例如某些集中种植的树更容易被移除出数据集。[1] 筛选增加了所保留记录的可解释性,也限制了覆盖范围;不能因为处理后的表格更整齐,就把它说成全部街道树的连续个体档案。

本文仅采用论文连续文字中的匹配、清理和核实说明,没有解读图表分布、计算树种生长率或给出危险树判断。城市绿化数据用于长期比较时,先说清记录怎样连成同一个体,变化数字才有明确的对象。

信息来源

本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。