Python爬虫实践入门，超详细，,1、前言学习Pyth

文章由Byrx.net分享于2021-06-09 02:06:30评论（685）

Python爬虫实践入门，超详细，,1、前言学习Pyth

1、前言

学习Python二个多月啦，周末时开始兴趣学习爬虫，虽然有点概念，但是也折腾了大半天，下面就开始简要记录一下吧。

2、需要的准备

Python：需要基本的python语法基础requests：专业用于请求处理，requests库学习文档中文版lxml：其实可以用pythonth自带的正则表达式库re，但是为了更加简单入门，用lxml中的 etree 进行网页数据定位爬取。
这里特别注意：不管你是为了Python就业还是兴趣爱好，记住：项目开发经验永远是核心，如果你没有2020最新python入门到高级实战视频教程，可以去小编的Python交流.裙：七衣衣九七七巴而五（数字的谐音）转换下可以找到了，里面很多新python教程项目，还可以跟老司机交流讨教！

通过pip安装 requests 和 lxml 库，在终端输入：

pip install requestspip install lxml复制代码

注：如果是安装到Python3就用pip3 install

下载过程成功的输出：

Collecting lxml  Cache entry deserialization failed, entry ignored  Downloading https://files.pythonhosted.org/packages/00/fd/5e65f293e366a63198dade275b886e5d24752367c2e67e3993023b0d58ef/lxml-4.2.3-cp36-cp36m-macosx_10_6_intel.macosx_10_9_intel.macosx_10_9_x86_64.macosx_10_10_intel.macosx_10_10_x86_64.whl (8.7MB)    100% |████████████████████████████████| 8.7MB 821kB/s Installing collected packages: lxmlSuccessfully installed lxml-4.2.3复制代码

注： 如果安装过程遇到任何问题，请谷歌吧，如果网上找不到答案，也不要问我！找不到答案我直播吃翔！！！3、实践过程
为了这过程有点兴趣，我找了一个美图的网站，爬虫了一波图片~
实践爬虫的网站链接：https://www点aitaotu点com（注意，这不是打广告！）
下载页面html内容：    page = ‘https://www点aitaotu点com/guonei/36350.html‘    data = requests.get(page).text    dom = etree.HTML(data)复制代码
解析(定位)元素:    title_path = ‘//*[@id="photos"]/h1/text()‘    totalpage_path = ‘//*[@id="picnum"]/span[2]/text()‘    image_path = ‘//*[@id="big-pic"]/p/a/img‘复制代码
这里的xpath怎么获取，就是网页里面，打开开发者检查元素工具，在safari和chrome都有这个功能：
注意：不管你是为了Python就业还是兴趣爱好，记住：项目开发经验永远是核心，如果你没有2020最新python入门到高级实战视频教程，可以去小编的Python交流.裙 ：七衣衣九七七巴而五（数字的谐音）转换下可以找到了，里面很多新python教程项目，还可以跟老司机交流讨教！
本文的文字及图片来源于网络加上自己的想法,仅供学习、交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理。
Python爬虫实践入门，超详细





 今日最新热门文章：
 python的安装配置及运行-Mac，,下载安装打开终
python中的类中属性元素加self.和不加self.的区
使用python处理selenium中的获取元素属性问题，
Python 字典(Dictionary) clear()方法-用于删除字典
07.Pythonset集合,深浅拷?以及部分知识点补充，
Python 技巧（三）—— list 删除一个元素的三

 

 相关内容

 python练习 函数2，,习题：定义一个方法g
linux重新安装python，,第一步：下载pyth
最火Python3 玩转实用小工具，,第1章 课程介绍介绍
python模块相关，,数字类型的相关模块：
【python】判断值是否在list和set的对比以及set的实现原理
7-45 jmu-python-涨工资 (10 分)，,输入一组工资数据，写
Python3.4 asyncio模块简介，,这个模块提供了在单个
Mathab和Python的numpy中的维度顺序，,本文比较Matlab
Python3.7之抽象类与归一化，,Python3.7之
Python 技巧（三）—— list 删除一个元素的三种做法，

推荐教程：python教程  python问答  python源码实例  python开发工具  python框架

Python爬虫实践入门，超详细，,1、前言学习Pyth

Python爬虫实践入门，超详细，,1、前言学习Pyth

1、前言

2、需要的准备

3、实践过程

相关内容

最新python教程

python~HOT