Python爬虫学习

Python 爬虫入门学习。

Python 爬虫

1. 准备环境

借助 requests 网络库请求 html 页面,而 beautifulsoup4 库则是一个可以从 HTML 或 XML 文件中提取数据的 Python 库, 然后安装 lxml 解析器,BeautifulSoup 可以使用它来解析 HTML,然后提取内容。

pip install requests pip install beautifulsoup4 pip install lxml

2. BeautifulSoup 库的使用

3. 参考资料