用 Python 爬虫,从入门到实战

从零到实战,系统学习 Python 爬虫。每节课包含概念讲解、可运行的 Python 示例、靶向网站实战练习与测验。 全部学习数据保存在浏览器本地,支持导出与导入。

13
课时
5
单元
5
综合测试
600
预计总分钟

开始学习 → 进入靶站

课程结构

单元 1 · 爬虫基础

3 节课

环境搭建、HTTP 原理、requests 库入门,建立爬虫的底层认知。

1.1环境搭建20 分钟
1.2HTTP 基础30 分钟
1.3requests 入门40 分钟

单元综合测试 →

单元 2 · 数据解析

3 节课

BeautifulSoup 与 XPath 两大解析利器,把网页变成可用的数据。

2.2XPath 解析40 分钟
2.3单页数据实战45 分钟

单元综合测试 →

单元 3 · 进阶爬取

3 节课

分页翻页、多级页面、JSON 接口与数据库存储,应对真实网站结构。

3.1分页与翻页45 分钟
3.2多级页面爬取50 分钟

单元综合测试 →

单元 4 · 反爬与动态页面

2 节课

动态渲染与常见反爬手段,学会与网站规则打交道的正确姿势。

4.2反爬对抗60 分钟

单元综合测试 →

单元 5 · 规范与综合实战

2 节课

爬虫伦理与合规,并用一个完整项目串联全部知识。

5.2综合项目实战90 分钟

单元综合测试 →

关于数据隐私:本站无后端服务器,你的学习进度、练习与测验成绩都只保存在当前浏览器的 localStorage 中。 换设备或清缓存前,请前往 学习中心 导出备份。