【发布时间】:2019-05-24 05:32:57
【问题描述】:
对编码非常陌生,如果我很傻但非常渴望学习,我深表歉意。 我正在使用 selenium 通过提取表格行来抓取网页(https://www.myinsuranceclub.com/health-insurance/star-health-network-hospital-list),如下面的代码所示。有人可以指导我如何为每个元素添加分隔符吗? 动机是将表格保存为 CSV 格式,分隔:name;;address;;city;;state;;pincode
# find_elements_by_xpath returns an array of selenium objects.
total = 302
j=1
while(j <= total):
i = 1
while(i <= 25):
titles_element = driver.find_elements_by_xpath("//*[@id='hospital_all']/tbody/tr[{}]".format(i))
i += 1
# use list comprehension to get the actual repo titles and not the selenium objects.
titles = [x.text for x in titles_element]
# print out all the titles.
print('titles:')
print(titles, '\n')
sys.stdout = open("data.txt", "a")
driver.find_element_by_xpath('//*[@id="hospital_all_next"]').click()
time.sleep(2)
j+=1
当前输出: 标题: ['Srinivasa Nursing Home Beside Natraj Talkies Adilabad Andhra Pradesh 504001'] 标题: ['Padmasri Hospitals # 49-48 - 16/5 Nggos Colony Near Roc Petrol Bunk Akkayyapalem Andhra Pradesh 530016']
预期输出: 标题: ['斯里尼瓦萨疗养院;;在 Natraj Talkies 旁边;;阿迪拉巴德;;安德拉邦;; 504001'] 标题: ['Padmasri 医院;; # 49-48 - 16/5 Nggos 殖民地靠近洛克汽油铺位;;阿卡亚帕莱姆;;安德拉邦;; 530016']
【问题讨论】:
标签: python-3.x firefox selenium-webdriver web-scraping