【发布时间】:2018-11-13 23:55:38
【问题描述】:
我有一个大的 4 列 csv 文件,其中包含随机值,我需要按特定列 ID 对行进行分组,然后在另一个文件中平均坐标。另外,我想保留小数位数。
ID, Latitude, Longitude, Cluster
1, 22.29124068, 19.59633257, 500
2, 22.28295135, 19.85912179, 214
3, 22.30154457, 19.65304535, 500
4, 22.29546953, 19.76508808, 214
5, 22.3322929, 19.75290081, 422
etc...
所以我需要做的是从 col[1] 和 col[2] 计算该文件中每个唯一集群 col[3] 的平均坐标并返回结果。
输出文件应该是:
ID, Latitude, Longitude, Cluster
1, <average_latitude_214 cluster>, <average_longitude_214 cluster>, 214
1, <average_latitude_500 cluster>, <average_longitude_500 cluster>, 500
and so on...
【问题讨论】:
-
太棒了..开始编码。遇到问题就回来。 SO 是关于修复你的代码——而不是实现你的想法。请再次查看how to ask 和on-topic,如果您有任何问题,请将您的代码提供为minimal verifyable complete example。如果您遇到错误,请将错误消息逐字(逐字)复制并粘贴到您的问题中。
-
谢谢@PatrickArtner!我设法对数据进行了排序,但我找不到关于如何平均每个集群的数据的示例
标签: python pandas csv sorting average