易教网
豆瓣爬虫项目
您需要购买才能继续观看该视频,立即购买
豆瓣爬虫项目

初一Python丨1节课丨上课时间:4月17日 - 4月17日

焦老师

主讲老师

python爬虫简析

网络爬虫,其实叫作网络数据采集更容易理解。

就是通过编程向网络服务器请求数据(HTML表单),然后解析HTML,提取出自己想要的数据。

归纳为四大步:

1.根据url获取HTML数据

2.解析HTML,获取目标信息

3.存储数据

4.重复第一步

这会涉及到数据库、网络服务器、HTTP协议、HTML、数据科学、网络安全、图像处理等非常多的内容。但对于初学者而言,并不需要掌握这么多。

爬虫可以用很多语言来写,python是比较受欢迎的一种。

如果你不懂python,那么需要先学习python这门非常easy的语言(相对其它语言而言)。

刚开始入门爬虫,你甚至不需要去学习python的类、多线程、模块之类的略难内容。找一个面向初学者的教材或者网络教程,花个十几天功夫,就能对python基础有个三四分的认识了,这时候你可以玩玩爬虫喽!