【问题标题】:How to get page html code using selenium?如何使用硒获取页面html代码?
【发布时间】:2023-01-14 14:24:15
【问题描述】:

我正在尝试使用 selenium 解析 cloudflare 网站。我可以在页面上找到单个元素,但我没有找到如何获取页面的整个代码。

options = webdriver.ChromeOptions()
options.add_argument('user-agent=')
options.add_argument('--disable-blink-features=AutomationControlled')

s = Service(executable_path='')
driver = webdriver.Chrome(service=s, options=options)

try:
    driver.get('https://mangalib.me/manga-list')
    time.sleep(10)
    print(driver.find_element_by_xpath(''))
except Exception as ex:
    print(ex)
finally:
    driver.close()
    driver.quit()

【问题讨论】:

    标签: python selenium cloudflare


    【解决方案1】:

    要获取您只需执行的完整源代码:

    driver.get('https://mangalib.me/manga-list')
    html = driver.page_source
    

    然后你可以用它做任何你想做的事

    【讨论】:

      【解决方案2】:

      如果你使用的是java

      在 webdriver 界面“获取页面资源()”是那里的一种方法。 在我提到的这段代码 sn-p 下面。它会给你总html代码的网页。

      public void getPgSource() {
          WebDriverManager.chromedriver().setup();
          ChromeDriver driver = new ChromeDriver();
          driver.get("https://www.tutorialspoint.com/java/java_basic_syntax.htm");
          String s = driver.getPageSource();
          System.out.println(s);
      }
      

      此方法返回字符串数据类型,因此您可以相应地使用。

      【讨论】:

      • 问题是关于 Python
      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2010-11-24
      • 1970-01-01
      • 2012-08-15
      • 2022-01-05
      • 1970-01-01
      • 2017-06-06
      相关资源
      最近更新 更多