【发布时间】:2021-11-29 08:33:53
【问题描述】:
我必须两次使用相同的功能。参数为df时为第一个,参数为df3时为第二个。怎么做?功能:
def add(df, df3):
df["timestamp"] = pd.to_datetime(df["timestamp"])
df = df.groupby(pd.Grouper(key = "timestamp", freq = "h")).agg("mean")
price = df["price"]
amount = df["amount"]
return (price * amount) // amount
双重用途:
out = []
# This loop will use the add(df) function for every csv and append in a list
for f in csv_files:
df = pd.read_csv(f, header=0)
# Replace empty values with numpy, not sure if usefull, maybe pandas can handle this
df.replace("", np.nan)
#added aggregate DataFrame with new column to list of DataFrames
out.append(add(df))
out2 = []
df3 = pd.Series(dtype=np.float64)
for f in csv_files:
df2 = pd.read_csv(f, header=0)
df3 = pd.concat([df3, df2], ignore_index=True)
out2 = pd.DataFrame(add(df = df3))
out2
我得到了错误:
TypeError: add() missing 1 required positional argument: 'df3'
【问题讨论】:
-
你调用你的函数
add(df),而你定义它需要两个参数。 -
我编辑了我的帖子,当我在第二个循环中写入 df = df3 时出现错误。我的代码是这样写的: - 函数 - 创建第一个数据帧然后在其上使用函数的循环 - 第二个循环创建第二个数据帧然后在其上使用函数
-
好吧,你真的不需要
def add(df, df3):。只需将函数定义为def add(df):。然后,当您想将其用于 df3 时,只需将 df3 作为参数传递,即add(df3) -
好吧,我得到的结果不是我想要的,但功能正常,感谢您的帮助,不便之处敬请见谅
标签: python dataframe function csv parameters