【发布时间】:2019-02-06 22:01:27
【问题描述】:
我有一个数据框,其中包含纬度、经度、hwmQualityName、海拔、描述和其他非必要信息的列。下面显示的是仅纬度、经度、hwmQualityName、海拔和描述的数据框。在 latitude 列之前、description 列之后以及 latitude、longitude、hwmQualityName、elev_ft 和 hwm_locationdescription 列之间的数据框中还有其他列的值:
import numpy as np
import matplotlib.pyplot as plt
import netCDF4 as nc4
import os
import sys
from plotly.offline import download_plotlyjs, init_notebook_mode, plot, iplot
init_notebook_mode(connected=True)
import plotly.offline as po
import plotly.graph_objs as go
from mpl_toolkits.basemap import Basemap
import pathlib as pl
import matplotlib as mpl
import pandas as pd
import sys;sys.path.append('../ncsurge')
from importlib import reload
import geopandas as gpd
from shapely.geometry import Point, MultiPoint
from shapely.ops import nearest_points
from hwm import *
root_hwm = pl.Path(r'P:\Temp\bpozo\Scripts\HWM')
A = pd.read_csv(str(root_hwm / 'FilteredHWMs.csv'))
hwm_m = gpd.GeoDataFrame(A)
hwm_m
latitude longitude hwmQualityName elev_ft hwm_locationdescription
35.281050926 -76.6625853795 'Excellent: +/- 0.05 ft' 7.288 'side of left garage'
34.676933 -77.080633 'Poor: +/- 0.40 ft' 12.241 'outside marked with pen'
...
34.94107586 -76.6507665736 'Good: +/- 0.10 ft' 6.025 'side of post'
这些点中有一定数量(例如 100 个)位于海岸线上,并且在地图上看到时彼此相对靠近。我想做的是几件事:
1) 我想将每个位置的 elev_ft 值与半径为 300 英尺的周围位置的 elev_ft 值进行比较,以确定我正在查看的位置的 elev_ft 值是否是异常值。
2) 在识别出具有异常值的 elev_ft 值的位置后,我想使用 hwmQualityName 列和 hwm_locationdescription 列中的字符串来删除包含hwmQualityName 列中的单词“Poor”或包含单词“waves”或 hwm_locationdescription 列中与 wave 相关的任何其他单词。
我希望最终得到的是一个数据框,它根据上述条件删除了点。
我是 Python 新手,不知道解决此任务的最佳方法。
我们将不胜感激。
【问题讨论】:
-
是沿海岸排列的纬度和经度,或者可以说位置1在顶部,位置2在底部,位置3又在顶部?
-
应该是后者。每个对应点的纬度和经度在数据框中的组织方式是它们是随机的无序地理点。例如(不查看确切位置),数据框中的第一个点可能位于相对于数据框中的第二个点更北的位置,但数据框中的第三个点可能位于第二个点的北边,但第一个点的南边,不一定是第一个和第二个数据帧点的南边。
标签: python