网创优客建站品牌官网
为成都网站建设公司企业提供高品质网站建设
热线:028-86922220
成都专业网站建设公司

定制建站费用3500元

符合中小企业对网站设计、功能常规化式的企业展示型网站建设

成都品牌网站建设

品牌网站建设费用6000元

本套餐主要针对企业品牌型网站、中高端设计、前端互动体验...

成都商城网站建设

商城网站建设费用8000元

商城网站建设因基本功能的需求不同费用上面也有很大的差别...

成都微信网站建设

手机微信网站建站3000元

手机微信网站开发、微信官网、微信商城网站...

建站知识

当前位置:首页 > 建站知识

怎么利用Python爬取网页内容

这篇文章主要讲解了“怎么利用Python爬取网页内容”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“怎么利用Python爬取网页内容”吧!

公司专注于为企业提供成都网站制作、成都网站设计、微信公众号开发、商城开发微信平台小程序开发,软件定制网站设计等一站式互联网企业服务。凭借多年丰富的经验,我们会仔细了解各客户的需求而做出多方面的分析、设计、整合,为客户设计出具风格及创意性的商业解决方案,成都创新互联更提供一系列网站制作和网站推广的服务。

编写执行代码

首先,你要安装requests和BeautifulSoup4,然后执行如下代码.
 
import requests
 
from bs4 import BeautifulSoup
 
iurl = 'http://news.sina.com.cn/c/nd/2017-08-03/doc-ifyitapp0128744.shtml'
 
res = requests.get(iurl)
 
res.encoding = 'utf-8'
 
#print(len(res.text))
 
soup = BeautifulSoup(res.text,'html.parser')
 
#标题
 
H1 = soup.select('#artibodyTitle')[0].text
 
#来源
 
time_source = soup.select('.time-source')[0].text
 
#来源
 
origin = soup.select('#artibody p')[0].text.strip()
 
#原标题
 
oriTitle = soup.select('#artibody p')[1].text.strip()
 
#内容
 
raw_content = soup.select('#artibody p')[2:19]
 
content = []
 
for paragraph in raw_content:
 
content.append(paragraph.text.strip())
 
'@'.join(content)
 
#责任编辑
ae = soup.select('.article-editor')[0].text

感谢各位的阅读,以上就是“怎么利用Python爬取网页内容”的内容了,经过本文的学习后,相信大家对怎么利用Python爬取网页内容这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是创新互联,小编将为大家推送更多相关知识点的文章,欢迎关注!


网页名称:怎么利用Python爬取网页内容
网站路径:http://bjjierui.cn/article/gscgsg.html

其他资讯