【发布时间】:2021-03-08 19:45:30
【问题描述】:
目前正在尝试创建一个 python 脚本来检查谷歌文档中的各种 SEO 页面指标。要执行我的检查,我需要能够拆分 H1、H2-H4、粗体文本等,这是我 previous request for help 关于拆分各种标题的后续问题。
以下是我拉标题的方式:
def read_paragraph_element(element):
text_run = element.get('textRun')
if not text_run:
return ''
return text_run.get('content')
def read_structural_elements(elements):
for value in elements:
if 'paragraph' in value and value['paragraph']['paragraphStyle']['namedStyleType'] == 'HEADING_2':
elements = value.get('paragraph').get('elements')
for elem in elements:
sub_headings += read_paragraph_element(elem)
当我尝试对粗体或斜体文本遵循类似的逻辑时,我最终得到一个空白列表:
for value in elements:
if 'paragraph' in value and value['paragraph']['paragraphStyle']['namedStyleType']['paragraphElement']['textStyle'] == 'bold':
elements = value.get('paragraph').get('elements')
for elem in elements:
sub_headings += read_paragraph_element(elem)
我对编码/python 还很陌生,正在努力寻找从这里开始的地方。
【问题讨论】:
标签: python-3.x google-api google-docs google-docs-api