python3爬虫获取html内容及各属性值的方法

更新时间：2018年12月17日 14:36:31 作者：android-李志强

今天小编就为大家分享一篇python3爬虫获取html内容及各属性值的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

今天用到BeautifulSoup解析爬下来的网页数据

首先导入包from bs4 import BeautifulSoup

然后可以利用urllib请求数据

记得要导包

import urllib.request

然后调用urlopen，读取数据

f=urllib.request.urlopen(‘http://jingyan.baidu.com/article/455a9950bc94b8a166277898.html‘) 
response=f.read()

这里我们就不请求数据了，直接用本地的html代码，如下

注意：”'xxx”'是多行注释

#python3
from bs4 import BeautifulSoup
html='''<html>
<head>
 <title class='ceshi'>super 哈哈 star</title>
</head>
<body>
 天下第一帅
 <p class='sister'>

  是不是
 </p>
</body>
</html>'''
#用BeautifulSoup解析数据 python3 必须传入参数二'html.parser' 得到一个对象，接下来获取对象的相关属性
html=BeautifulSoup(html,'html.parser')
# 读取title内容
print(html.title)
# 读取title属性
attrs=html.title.attrs
print(attrs)
# 获取属性attrs['class'] ---->['ceshi'] 这是一个list 通过下标可以获取值
print(attrs['class'][0])
# 读取body
print(html.body)
读取数据还可以通过BeautifulSoup的select方法
html.select()
#按标签名查找 
soup.select('title')
soup.select('body')
# 按类名查找
soup.select('.sister')
# 按id名查找
# p标签中id为link的标签
soup.select('p #link')
#取标签里面的值
soup.p.string
#取标签里属性值 通过href获取
html['href']

以上这篇python3爬虫获取html内容及各属性值的方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持脚本之家。

您可能感兴趣的文章:

对python tkinter窗口弹出置顶的方法详解
今天小编就为大家分享一篇对python tkinter窗口弹出置顶的方法详解，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-06-06
Django网络框架之创建虚拟开发环境操作示例
这篇文章主要介绍了Django网络框架之创建虚拟开发环境操作,简单描述了虚拟开发环境的概念、功能,并分析了使用venv与virtualenv安装虚拟环境相关操作技巧,需要的朋友可以参考下
2019-06-06
在 Python 应用中使用 MongoDB的方法
这篇文章主要介绍了在 Python 应用中使用 MongoDB的方法,需要的朋友可以参考下
2017-01-01
Python logging模块写入中文出现乱码
这篇文章主要介绍了Python logging模块写入中文出现乱码,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
2020-05-05
Python操作json数据的一个简单例子
这篇文章主要介绍了Python操作json数据的一个简单例子,需要的朋友可以参考下
2014-04-04
python3.7 openpyxl 删除指定一列或者一行的代码
这篇文章主要介绍了python3.7 openpyxl 删除指定一列或者一行,文中通过代码给大家介绍了python3 openpyxl基本操作，代码简单易懂，需要的朋友可以参考下
2019-10-10
JS设计模式之责任链模式实例详解
这篇文章主要介绍了JS设计模式之责任链模式,结合实例形式详细分析了责任链模式的概念、原理、功能、使用场景及相关操作技巧,需要的朋友可以参考下
2018-02-02
在Python的Flask中使用WTForms表单框架的基础教程
WTForms由Python写成,为表单而生,提供了很多制作Web表单的实用API,和Flask框架结合使用效果拔群,这里我们就一起看一下在Python的Flask中使用WTForms表单框架的基础教程
2016-06-06
浅析python中numpy包中的argsort函数的使用
这篇文章主要介绍了python中numpy包中的argsort函数的使用，argsort()函数在模块numpy.core.fromnumeric中，本文通过实例代码给大家介绍的非常详细，需要的朋友参考下吧
2018-08-08
python绘制浅色范围曲线的示例代码
这篇文章主要介绍了python绘制浅色范围曲线,本文通过示例代码给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值，需要的朋友可以参考下
2021-10-10

python3爬虫获取html内容及各属性值的方法

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具