【问题标题】:create interpolated polygons from GPS data with value column使用值列从 GPS 数据创建插值多边形
【发布时间】:2020-12-17 10:19:28
【问题描述】:

我有一些 GPS 数据,每个点都有一个值(就像空气质量一样)。我可以绘制这些点,例如用 folium,然后将值映射到圆的大小,如下所示:

import pandas, numpy, folium
lat = numpy.random.uniform(45, 45.01, 250)
lon = numpy.random.uniform(3, 3.02, 250)
value = numpy.random.uniform(0,50,250)
df = pandas.DataFrame({'lat': lat, 'lon': lon, 'value': value})
mymap = folium.Map(location = [lat.mean(), lon.mean()], tiles="OpenStreetMap", zoom_start=14)
for elt in list(zip(df.lat, df.lon, df.value)):
    folium.Circle(elt[:2], color="blue", radius=elt[2]).add_to(mymap)
mymap.save('mymap.html')

我想处理这些数据,对其进行插值并创建一个 shapefile 作为输出,其中插入的多边形包含平均值并显示高值和低值区域(右侧的图片)。当然,多边形的限制会通过插值自动生成。

我怎样才能做到这一点?因为我曾尝试在 folium 中使用 HeatMap 工具,但它旨在插入点的密度,而不是与每个点关联的值! 我希望它不是太复杂..谢谢, 注意:我使用 folium,但我可以使用其他 python 库。

【问题讨论】:

  • 除了空间还有时间维度吗?地图是否需要动态的,比如folium map?
  • @jlandercy 好吧,不在我的用例中。但如果它是免费的.. .:-)
  • 注意folium中还有HeatMapWithTime对象。

标签: python dataframe interpolation raster folium


【解决方案1】:

我们可以将值作为权重提供给 folium 中的 HeatMap(请参阅文档中的 data 参数)。

这是一个例子。我将框下半部分的值除以 5,以证明尽管数据点的密度相对均匀,但热图在图片的上半部分清楚地显示出更高的量级:

import pandas as pd
import numpy as np
import folium
from folium.plugins import HeatMap
import matplotlib as mpl

# parameters
n = 250                     # number of points
lat0 = 40.7                 # coordinates will be generated uniformly with
lon0 = -73.9                # lat0 - eps <= lat < lat0 + eps
eps = 0.1                   # lon0 - eps <= lon < lon0 + eps
v_min, v_max = 0, 100       # min, max values

# generating values
lat = np.random.uniform(lat0 - eps, lat0 + eps, n)
lon = np.random.uniform(lon0 - eps, lon0 + eps, n)
value = numpy.random.uniform(v_min, v_max, n)
df = pandas.DataFrame({'lat': lat, 'lon': lon, 'value': value})

# to demonstrate the effect of weights on the heatmap,
# we'll divide values below the center of the box by K = 5
K = 5
df.loc[df['lat'] < lat0, 'value'] /= K

# plotting the map, both the points themselves and the heatmap
m = folium.Map(location = [lat0, lon0], tiles="OpenStreetMap",
               zoom_start=11, width=400, height=400)
for elt in list(zip(df.lat, df.lon, df.value)):
    folium.Circle(elt[:2], color="white", radius=elt[2]).add_to(m)

# df.values used here is a (250, 3) numpy.ndarray
# with (lat, lon, weight) for each data point
HeatMap(data=df.values, min_opacity=0.1).add_to(m)

m

输出:


更新:

这是一种稍微不同的方法,不使用内置的热图(根据@agenis 提到的https://github.com/python-visualization/folium/issues/1271,这可能是目前更好的选择)。

我们首先转换我们的数据,制作正方形网格,其中每个正方形的值是位于该单元格内的原始数据点值的平均值(因此它不取决于该单元格内的点数,仅取决于它们的值)。

然后我们可以通过在地图上绘制 GeoJson 多边形来可视化这些正方形。这是一个例子:

# define the size of the square
step = 0.02

# calculate values for the grid
x = df.copy()
x['lat'] = np.floor(x['lat'] / step) * step
x['lon'] = np.floor(x['lon'] / step) * step
x = x.groupby(['lat', 'lon'])['value'].mean()
x /= x.max()
x = x.reset_index()

# geo_json returns a single square
def geo_json(lat, lon, value, step):
    cmap = mpl.cm.RdBu
    return {
      "type": "FeatureCollection",
      "features": [
        {
          "type": "Feature",
          "properties": {
            'color': 'white',
            'weight': 1,
            'fillColor': mpl.colors.to_hex(cmap(value)),
            'fillOpacity': 0.5,
          },
          "geometry": {
            "type": "Polygon",
            "coordinates": [[
                [lon, lat],
                [lon, lat + step],
                [lon + step, lat + step],
                [lon + step, lat],
                [lon, lat],
              ]]}}]}


# generating a map...
m = folium.Map(location=[lat0, lon0], zoom_start=11, width=400, height=400)

# ...with squares...
for _, xi in x.iterrows():
    folium.GeoJson(geo_json(xi['lat'], xi['lon'], xi['value'], step),
                   lambda x: x['properties']).add_to(m)

# ...and the original points
for elt in list(zip(df.lat, df.lon, df.value)):
    folium.Circle(elt[:2], color="white", radius=elt[2]).add_to(m)

m

输出:


更新(2):

这是一个使用griddata在网格上进行插值的版本:

import pandas as pd
import numpy as np
import folium
from scipy.interpolate import griddata

# parameters
n = 250                     # number of points
lat0 = 40.7
lon0 = -73.9
eps = 0.1
v_min, v_max = 0, 100       # min, max values

# generating values
lat = np.random.normal(lat0, eps, n)
lon = np.random.normal(lon0, eps, n)
value = numpy.random.uniform(v_min, v_max, n)

# set up the grid
step = 0.02
xi, yi = np.meshgrid(
    np.arange(lat.min() - step/2, lat.max() + step/2, step),
    np.arange(lon.min() - step/2, lon.max() + step/2, step),
)

# interpolate and normalize values
zi = griddata((lat, lon), value, (xi, yi), method='linear')
zi /= np.nanmax(zi)
g = np.stack([
    xi.flatten(),
    yi.flatten(),
    zi.flatten(),
], axis=1)

# geo_json returns a single square
def geo_json(lat, lon, value, step):
    cmap = mpl.cm.RdBu
    return {
      "type": "FeatureCollection",
      "features": [
        {
          "type": "Feature",
          "properties": {
            'color': 'white',
            'weight': 1,
            'fillColor': mpl.colors.to_hex(cmap(value)),
            'fillOpacity': 0.5,
          },
          "geometry": {
            "type": "Polygon",
            "coordinates": [[
                [lon - step/2, lat - step/2],
                [lon - step/2, lat + step/2],
                [lon + step/2, lat + step/2],
                [lon + step/2, lat - step/2],
                [lon - step/2, lat - step/2],
              ]]}}]}


# generating a map...
m = folium.Map(location=[lat0, lon0], zoom_start=9, width=400, height=400)

# ...with squares...
for gi in g:
    if ~np.isnan(gi[2]):
        folium.GeoJson(geo_json(gi[0], gi[1], gi[2], step),
                       lambda x: x['properties']).add_to(m)

# ...and the original points
for elt in list(zip(lat, lon, value)):
    folium.Circle(elt[:2], color='white', radius=elt[2]).add_to(m)

m

输出:

【讨论】:

  • 谢谢,这是一个很好的贡献。但是我已经阅读了有关权重参数的内容,它说结果将始终是点密度和权重的组合。是否可以完全消除热图中点密度的影响?我猜算法聚合了权重,所以更多的点意味着更多的权重,不管这个点的值是多少。
  • @agenis 您能否发布您已阅读的参考资料。 HeatMap 通常会在其渲染的区域上汇总权重。如果您不使用点密度进行归一化,您将不会收敛于均值,因此您正在寻找密度。除以点代表的区域的表面积也很常见。这些标准化之间的选择基本上取决于变量的性质。对于浓度,它通常只是通过点的密度归一化以收敛到平均值。
  • 我读了两篇文章。这首先是关于热图权重的错误,但显然它已关闭 github.com/python-visualization/folium/issues/1271 在我们正在讨论的问题上第二次:github.com/python-visualization/folium/issues/902
  • @agenis 是的,这很好,我也找到了那些(在发布原始解决方案之后)。我已经用另一种方法进行了更新。我们首先通过在网格上取原始值的平均值来转换数据,因此我们不再依赖点集中度。然而,他们实现 HeatMap 本身仍然存在这个问题,所以我转而使用 GeoJSON 多边形构建方形单元格。更多参与,但绝对更强大
  • 也许我们可以简化它并使用griddata 在我们没有任何数据点的单元格中插入值?我在上面发布了一个示例(在“更新(2)”中)
【解决方案2】:

在我看来,您需要过滤数据,以便根据给定类别将其分成组。使用这些点集,您应该能够生成凸包。似乎有一些方法可以在 scipy 中执行此操作 - 请参阅此处以获取一些示例: Convex hull area in Python?

【讨论】:

  • 谢谢,但我想这最终会得到一组不连续的多边形(外壳),它们之间会有一些间隙和一些重叠(具有未知值)。
  • 确实;收缩/扩展它们以便卡在一起并不难。我曾经用我的旧实现手动执行此操作,因为我有与您类似的要求(没有重叠或间隙)。我敢肯定有人已经写了一些东西来修复这些缺陷。
  • 基本上,您正在寻找“多边形捕捉”或“将多边形转换为网格”算法。在此基础上还有另一个 SO 问题:stackoverflow.com/questions/7495487/convert-polygons-into-mesh。 .关于从蜂窝矩形制作多边形还有另一个问题 - 有可用的空间联合算法来做到这一点。见这里:stackoverflow.com/questions/643995/…
猜你喜欢
  • 2018-12-13
  • 2016-12-20
  • 1970-01-01
  • 1970-01-01
  • 2020-06-07
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多