靶向练习站

这是课程专用的「待爬取」目标网站,按难度分 5 个等级,全部部署在本站的 /practice/ 目录下。 你可以用本地 Python,也可以直接在本页下面的浏览器运行区里用 requests 抓取—— 因为同源,浏览器运行器可以直接请求这些页面。

Level 1 · 单页表格

第 06 课

一个静态页面,24 本书的热销榜单。适合 requests + BeautifulSoup 入门练习。

打开靶站 →

Level 2 · 路径分页

第 07 课

10 页 × 10 本图书,URL 按 page/1.html … page/10.html 递增。

打开靶站 →

Level 3 · 列表 + 详情

第 08 课

列表页链接到 20 个独立详情页,练习两级页面爬取。

打开靶站 →

Level 4 · JSON 接口

第 09 课

分页 JSON 接口,练习直接请求 API 与解析 JSON。

打开靶站 →

Level 5 · 动态渲染

第 10 课

数据由 JavaScript 动态加载,练习 Playwright 或查找底层接口。

打开靶站 →

伦理提醒:本站所有靶站均为教学用虚构数据。练习真实网站前,请务必阅读其robots.txt,控制请求频率,遵守相关法律法规。

就地练习

直接抓取 Level 1 靶站试试(同源请求,浏览器运行器即可完成)。这是挑战模式:不直接给参考代码, 先按任务尝试写,实在卡住再展开查看。