Extremelybold','lxml') tag=soup.b type(tag)
bs4.element.Tag

2.Tag的Name属性

每个tag都有自己的名字,通过.name来获取

tag.name
'b'
tag.name="blockquote"#对原始文档进行修改
tag
Extremelybold

3.Tag的Attributes属性

获取单个属性

tag['class']
['boldest']

按字典的方式获取全部属性

tag.attrs
{'class':['boldest']}

添加属性

tag['class']='verybold'
tag['id']=1
print(tag)
Extremelybold

删除属性

deltag['class']
deltag['id']
tag
Extremelybold

4.Tag的多值属性

多值属性会返回一个列表

css_soup=BeautifulSoup('

','lxml') print(css_soup.p['class'])
['body','strikeout']
rel_soup=BeautifulSoup('

Backtothehomepage

','lxml') print(rel_soup.a['rel']) rel_soup.a['rel']=['index','contents'] print(rel_soup.p)
['index']

Backtothehomepage

如果转换的文档是XML格式,那么tag中不包含多值属性

xml_soup=BeautifulSoup('

','xml') xml_soup.p['class']
'bodystrikeout'

二、可遍历字符串(NavigableString)

1.字符串常被包含在tag内,使用NavigableString类来包装tag中的字符串

frombs4importBeautifulSoup
soup=BeautifulSoup('Extremelybold','lxml')
tag=soup.b
print(tag.string)
print(type(tag.string))
Extremelybold

2.一个NavigableString字符串与Python中的str字符串相同,通过str()方法可以直接将NavigableString对象转换成str字符串

unicode_string=str(tag.string)
print(unicode_string)
print(type(unicode_string))
Extremelybold

3.tag中包含的字符串不能编辑,但是可以被替换成其它的字符串,用replace_with()方法

tag.string.replace_with("Nolongerbold")
tag
Nolongerbold

三、BeautifulSoup对象BeautifulSoup对象表示的是一个文档的全部内容。

大部分时候,可以把它当作Tag对象,它支持遍历文档树和搜索文档树中描述的大部分的方法。

四、注释与特殊字符串(Comment)对象

markup=""
soup=BeautifulSoup(markup,'lxml')
comment=soup.b.string
type(comment)
bs4.element.Comment

Comment对象是一个特殊类型的NavigableString对象

comment
'Hey,buddy.Wanttobuyausedparser?'

更多关于Python爬虫库BeautifulSoup的使用方法请查看下面的相关链接

声明:本文内容来源于网络,版权归原作者所有,内容由互联网用户自发贡献自行上传,本网站不拥有所有权,未作人工编辑处理,也不承担相关法律责任。如果您发现有涉嫌版权的内容,欢迎发送邮件至:czq8825#qq.com(发邮件时,请将#更换为@)进行举报,并提供相关证据,一经查实,本站将立刻删除涉嫌侵权内容。

热门推荐

1 岳母生日贺卡祝福语简短
2 小班小孩生日祝福语简短
3 赞美祝福语大全简短的
4 中秋骚气祝福语简短情人
5 简短有内涵新年祝福语
6 家长对中考祝福语 简短
7 乔迁祝福语简短精辟句子
8 孩子过生日简短祝福语
9 朋友之间祝福语大全简短
10 立春幽默祝福语简短
11 朋友升迁的祝福语简短
12 简单生日祝福语简短大全
13 朋友的孩子祝福语简短
14 中考祝福语 简短50字
15 新年祝福语2026最简短
16 便利贴老师祝福语简短
17 佛学生日简短祝福语
18 年末祝福语简短小清新