【问题标题】:Pandas issue extracting hyperlinks from excelPandas 从 excel 中提取超链接的问题
【发布时间】:2020-03-04 10:17:50
【问题描述】:

此 Python 脚本的目标是为输入的任何状态找到相应的 URL。在脚本的“查找”部分,我不断收到这些错误。输入的名称是“状态”。该代码在 url 被硬编码时有效,但我不断收到以下错误与查找值。

请看下面的代码和结果

df = pd.read_excel(r'C:/Users/user.name/Desktop/PythonScript_Data_medverify.xlsx',sheet_name = 'Sheet1', dtype=str)
df.to_excel(r'C:/Users/user.name/Desktop/PythonScript_Data_medverify.csv.xlsx')

df['URL'] = df['URL'].astype('|S80')
stateurl =(df[df['State']==state]['URL'])
print(stateurl)

打印结果:

8    b'https://incomplete.url/tes...
Name: URL, dtype: object

每当我使用我的网络爬虫(使用硬编码的 url 运行)运行时,代码都会在 selenium 中引发错误,它无法打开“无效 URL”

【问题讨论】:

  • 试试stateurl =df[df['State']==state]['URL'].iloc[0]
  • 或者stateurl = df[df['State']==state]['URL'].values[0]
  • 那些工作完美。我知道这将是一件非常微不足道的事情。谢谢!!

标签: python json pandas scripting


【解决方案1】:
stateurl =df[df['State']==state]['URL'].iloc[0] 

Suraj Motaparthy 得到了我正在寻找的语法

【讨论】:

    猜你喜欢
    • 2016-08-26
    • 2015-11-20
    • 1970-01-01
    • 1970-01-01
    • 2021-02-01
    • 2015-07-06
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多