- 通过网站域名获取HTML数据
- 解析数据,获取想要的信息
- 存储爬取的信息
- 如果有必要,移动到另一个网页重复过程
这本书上的代码的网址是 : GitHub - REMitchell/python-scraping: Code samples from the book Web Scraping with Python http://shop.oreilly.com/product/0636920034391.do
如何下载代码:
1、登录上面的网站,复制网址
2、使用git
3、输入git clone 上面复制的网址,敲回车就可以了。