pozhu15

第一次写贴子,试试水

很多玩Python3的都会遇到编码问题,如果直接去处理未知编码的网页,不是Python内部编码格式utf8会出现乱码,下面介绍一种将未知编码的字串转换为utf8来避免乱码的方法,

在很多Python编码转换的场景中都可以使用,

这段是自己写的爬虫中的一段代码,代码比较简短,聪明的你一定能抓住其中的重点

#请求网页并转网页编码
def getHtmlAndDealCode(url):
    #html=requests.get(url,verify=False)
    html = s.get(url,headers=header)
    code=html.encoding
    html=html.text
    html=html.encode(code)
    html=html.decode(\'utf-8\')
    parser = \'html.parser\'
    soup = BeautifulSoup(html ,parser)
    return soup

 

分类:

技术点:

相关文章:

  • 2022-12-23
  • 2021-10-30
  • 2021-09-01
  • 2021-09-09
  • 2022-12-23
  • 2022-12-23
  • 2021-11-15
  • 2021-05-28
猜你喜欢
  • 2021-12-25
  • 2021-12-25
  • 2021-11-12
  • 2022-01-29
  • 2021-07-05
  • 2022-01-07
  • 2021-07-17
相关资源
相似解决方案