python爬虫中BeautifulSoup如何使用-创新互联

这篇文章主要介绍python爬虫中Beautiful Soup如何使用,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!

巴楚网站建设公司创新互联公司,巴楚网站设计制作,有大型网站制作公司丰富经验。已为巴楚千余家提供企业网站建设服务。企业网站搭建\外贸营销网站建设要多少钱,请找那个售后服务好的巴楚做网站的公司定做!

一、Tag

Tag 是什么?通俗点讲就是 HTML 中的一个个标签,例如

The Dormouse's story
Elsie

二、NavigableString

既然我们已经得到了标签的内容,那么问题来了,我们要想获取标签内部的文字怎么办呢?很简单,用 .string 即可,例如

print soup.p.string
#The Dormouse's story

三、BeautifulSoup

BeautifulSoup 对象表示的是一个文档的全部内容。大部分时候,可以把它当作 Tag 对象,是一个特殊的 Tag,我们可以分别获取它的类型,名称,以及属性来感受一下

print type(soup.name)
#
print soup.name
# [document]
print soup.attrs
#{} 空字典

四、Comment

Comment 对象是一个特殊类型的 NavigableString 对象,其实输出的内容仍然不包括注释符号,但是如果不好好处理它,可能会对我们的文本处理造成意想不到的麻烦。 我们找一个带注释的标签

print soup.a
print soup.a.string
print type(soup.a.string)

以上是python爬虫中Beautiful Soup如何使用的所有内容,感谢各位的阅读!希望分享的内容对大家有帮助,更多相关知识,欢迎关注创新互联行业资讯频道!


名称栏目:python爬虫中BeautifulSoup如何使用-创新互联
本文路径:http://myzitong.com/article/dscipg.html